【发布时间】:2016-11-03 00:11:15
【问题描述】:
如果使用 Yarn 调度程序,Spark 的任务执行似乎是以内存为中心的。如果它发现任务的内存可以容纳更少的节点,它就不会使用所有可用节点来运行这些任务。有没有办法,我可以让 Yarn 使用所有节点,而不是通过增加执行器/容器的内存来欺骗它?
【问题讨论】:
-
您是否尝试过传入
spark-submitarg--num-executors n其中 n 是您希望应用程序使用的节点数
标签: apache-spark hadoop-yarn bigdata