【发布时间】:2015-05-14 08:14:08
【问题描述】:
我需要做什么才能在 Hadoop 中拥有更小/更大的块?
具体来说,我希望拥有更多数量的映射器,以便处理更小的数据。似乎我需要减小块大小,但我很困惑(我是 Hadoop 新手)——我需要在将文件放在 HDFS 上时做些什么,还是需要指定与输入拆分大小相关的东西,还是两者兼有?
我正在共享集群,所以我无法执行全局设置,所以如果可能的话,是否需要在每个作业的基础上执行此操作?我正在从代码(可能后来从 Oozie)运行这项工作。
【问题讨论】:
标签: hadoop