【发布时间】:2018-11-26 06:20:51
【问题描述】:
我正在运行 Java 代码以在 spark 提交中使用 Spark 集群模式将文件从 HDFS 复制到本地。 该作业在本地火花中运行良好,但在集群模式下失败。 它抛出一个 java.io.exeception:目标 /mypath/ 是一个目录。
我不明白为什么它在集群中失败。但我在本地没有收到任何异常。
【问题讨论】:
-
由于您是在集群模式下运行作业,因此并行运行的进程很少。他们每个人都有自己的日志,您需要在那里检查确切的堆栈跟踪。
-
尝试输入完全限定的 hdfs 路径。
标签: java apache-spark hdfs spark-streaming spark-submit