首页> 中文期刊>智能计算机与应用 >一种Hadoop小文件存储优化策略研究

一种Hadoop小文件存储优化策略研究

     

摘要

随着“大数据”时代的到来,Hadoop等大数据处理平台也应运而生.但其存储载体——Hadoop分布式文件系统却在海量小文件存储方面存在着很大缺陷,存储海量小文件会导致整个集群的负载增高、运行效率下降.为了解决这一针对小文件的存储缺陷,通常的方法是将小文件进行合并,将合并后的大文件进行存储,但以往方法并未将文件体积大小分布加以利用,未能进一步提升小文件合并效果.本文提出一种基于数据块平衡的小文件合并算法,优化合并后的大文件体积分布,有效降低HDFS数据分块,从而减少集群主节点内存消耗、降低负载,使数据处理过程可以更高效的运行.

著录项

  • 来源
    《智能计算机与应用》|2015年第3期|28-32,36|共6页
  • 作者

    杜忠晖; 何慧; 王星;

  • 作者单位

    哈尔滨工业大学计算机科学与技术学院,哈尔滨150001;

    哈尔滨工业大学计算机科学与技术学院,哈尔滨150001;

    哈尔滨工业大学计算机科学与技术学院,哈尔滨150001;

  • 原文格式 PDF
  • 正文语种 chi
  • 中图分类 TP391.41;
  • 关键词

    HDFS; 小文件存储; 小文件合并算法;

  • 入库时间 2023-07-25 11:15:51

相似文献

  • 中文文献
  • 外文文献
  • 专利
获取原文

客服邮箱:kefu@zhangqiaokeyan.com

京公网安备:11010802029741号 ICP备案号:京ICP备15016152号-6 六维联合信息科技 (北京) 有限公司©版权所有
  • 客服微信

  • 服务号