【发布时间】:2014-01-26 02:24:11
【问题描述】:
我有一个包含 20 个节点的 hadoop 集群,其中 15 个节点有 1 个同名文件(在其本地文件系统上)。在 Map Reduce 程序中读取所有这 15 个文件的最佳方法是什么?
一种方法是在这 15 个节点中的每一个节点上手动运行“hadoop fs -put..”命令以将文件复制到 HDFS,但每个节点在 HDFS 上具有不同的名称,然后在 map reduce 程序中从 HDFS 读取文件但想知道是否有更好的选择可以避免这种手动转移。
谢谢!!
【问题讨论】:
标签: hadoop