【发布时间】:2015-09-09 18:08:38
【问题描述】:
我在 hdfs 上使用 sparksql。
每个 hdfs 节点都有一个 spark slave 运行。
当我运行大型查询时,hdfs 似乎正在节点之间发送数据以触发从属服务器。
为什么 HDFS 不使用本地数据服务本地 spark?
所有任务都显示为 ANY 的位置级别。
我什至设置 spark.locality.wait=10000.
有什么遗漏或需要看的吗?
谢谢,
【问题讨论】:
标签: apache-spark hdfs apache-spark-sql