你好,游客 登录 注册 搜索
背景:
阅读新闻

[期刊]基于Hadoop的电网数据质量校验方法与验证系统

[日期:2015-07-14] 来源:计算机研究与发展  作者:张志亮 孙煜华 陈承志 龙庆麟 梁国辉 顾荣 杨滨诚 黄宜华 [字体: ]

基于Hadoop的电网数据质量校验方法与验证系统

张志亮 孙煜华 陈承志 龙庆麟 梁国辉 顾荣 杨滨诚  黄宜华

在诸多电网数据处理应用中,电网数据质量监测是电网大数据处理业务中最重要的一个环节。随着电网数据规模和数据质量校验规则数量和复杂度的不断增大,目前现有的基于传统数据库系统和计算平台的数据质量校验系统的处理能力已经出现严重的瓶颈,难以快速完成数据质量的监测和校验,且系统难以扩展,越来越难以满足日常的生产管理和经营决策的需求。大数据技术为解决电网大数据处理提供了良好的技术手段和支撑平台。为此,本文提出了一种基于大数据的电网数据质量校验解决方案,研究设计了基于 Hadoop 平台的分布式数据存储管理和并行化校验规则执行技术,选择批量和增量数据质量校验典型场景,进行了验证性研究,设计实现了针对数据校验的索引存储机制,对校验规则相关的属性建立快速索引,并进一步设计实现了基于HBase 和 MapReduce 的并行化校验规则执行算法,使得数据质量校验的处理性能得到显著提升。


基于Hadoop的电网数据质量校验方法与验证系统

收藏 推荐 打印 | 录入:574107552 | 阅读:
相关新闻      
本文评论   查看全部评论 (0)
表情: 表情 姓名: 字数
点评:
       
评论声明
  • 尊重网上道德,遵守中华人民共和国的各项有关法律法规
  • 承担一切因您的行为而直接或间接导致的民事或刑事法律责任
  • 本站管理人员有权保留或删除其管辖留言中的任意内容
  • 本站有权在网站内转载或引用您的评论
  • 参与本评论即表明您已经阅读并接受上述条款