【发布时间】:2017-02-10 00:29:43
【问题描述】:
我有一个带有 1 个主节点和 2 个节点(worker + datanode)的 spark 集群。
我想添加另一个数据节点。
问题是,当我做hdfs dfs -setrep -R -w 2 时,结果是:
1st datanode -> DFS Used%: 75.61%
2nd datanode -> DFS Used%: 66.78%
3rd datanode -> DFS Used%: 8.83%
您知道如何平衡 hdfs 中的块,以使每个块大约为 30 -> 33%?
谢谢
【问题讨论】:
-
您应该设置三个副本,以便所有三个数据节点都可以使用。
标签: hadoop apache-spark hdfs