1. 首页
  2. 移动开发
  3. 其他
  4. 论文研究 单机下Hadoop小文件处理性能分析.pdf

论文研究 单机下Hadoop小文件处理性能分析.pdf

上传者: 2020-07-20 10:18:57上传 PDF文件 483.95KB 热度 15次
Hadoop主要是针对大量数据进行分布式处理的软件框架,即适合于处理大文件,但它们是否也适合处理小文件值得商榷。以词频统计为例,通过在单机环境下一些典型文件测试集的实验,对比了不同文件输入格式对Hadoop处理小文件性能的差异。从Hadoop的工作流程和原理上解释了出现此性能差异的原因。通过分析得出多个小文件整合为一个数据片split有助于改善Hadoop处理小文件性能。
用户评论