当前位置: 首页 电子通信 电子信息 基于云计算的海量大数据智能清洗系统设计

基于云计算的海量大数据智能清洗系统设计

收藏
  • 大小:1.62 MB
  • 语言:中文版
  • 格式:PDF文档
  • 类别:电子信息
关键词:海量   清洗   智能   数据   云计算

资源简介

大数据资源是企业拥有的最重要的战略资源之一,也是管理层制定远景规划,提高市场竞争力的主要方式和途径,但大数据中会存在错误、冗余和不完整的数据,降低了大数据的总体质量。为此设计一种基于云计算的海量大数据智能清洗系统,改善现有大数据清洗系统在脏数据处理性能上的不足。分析了基于云计算的大数据智能清洗系统的总体框架和硬件构成,数据清洗系统的硬件部分由数据预处理模块、数据云聚类模块、数据识别模块和实体划分模块等部分组成;给出了智能大数据清洗系统的总体软件工作流程,并重点分析大数据空间聚类、相似度计算等关键的数据处理技术。验证结果表明,提出的基于云计算的海量大数据智能清洗系统设计的总体功能性较为完善,在系统性能测试方面也能够保持95%以上的数据查准率和召回率。
  • 资料为PDF文档格式.
  • 本文档关键词:海量,清洗,智能,数据,云计算
  • 下载地址