【发布时间】:2017-03-25 19:05:55
【问题描述】:
我们正在尝试使用 ZK 设置 Spark HA 设置。 我们有 2 台机器用于 Spark 进程的 Master 和另外 3 台用于 Spark Slaves 的机器 在 spark-env.sh 中完成 Spark HA 的 Master Machine 中的配置如下:
# - SPARK_DAEMON_JAVA_OPTS, to set config properties for all daemons (e.g. "-Dx=y")
export SPARK_DAEMON_JAVA_OPTS="-Dspark.deploy.recoveryMode=ZOOKEEPER -Dspark.deploy.zookeeper.url=DEV-SMP-Manager01:2181DEV-SMP-Worker01:2181,DEV-SMP-Worker05:2181"
其中 DEV-SMP-Manager01:2181DEV-SMP-Worker01:2181,DEV-SMP-Worker05:2181 是 ZK Quorum。他们已经启动并运行。 在下面提到的 spark 配置文件中添加了 curator jar。 当我们使用命令 sbin/start-master.sh 启动 master(s) 时,
它们都以“STANDBY”的形式出现,火花日志中没有错误。在这里我们被卡住了,知道我的 spark-env 出了什么问题,如下所示:-
导出 SPARK_DIST_CLASSPATH=$(/home/hduser/smp/hadoop-2.5.1/bin/hadoop 类路径) 导出 SPARK_DIST_CLASSPATH=$SPARK_DIST_CLASSPATH:/home/hduser/smp/spark-1.6.1-bin-without-hadoop/curator-client-2.0.0-incubating.jar:/home/hduser/smp/spark-1.6.1- bin-without-hadoop/curator-framework-2.2.0-incubating.jar
export SPARK_DAEMON_JAVA_OPTS="-Dspark.deploy.recoveryMode=ZOOKEEPER -Dspark.deploy.zookeeper.url=DEV-SMP-Manager01:2181DEV-SMP-Worker01:2181,DEV-SMP-Worker05:2181" 当我看到两个 web UI 的 machine:8080 时,我们看到 master 的状态 = STANDBY 并且其中任何一个都没有显示任何工作人员。尽管所有工人都已启动并运行。任何线索都会有所帮助。理想情况下,一个主人应该现场展示所有的工人,但这里两个主人都处于待命状态,没有工人为任何主人展示?
使用的版本:- 火花-火花-1.6.1 ZK - 3.4.6
【问题讨论】:
-
是否将相同的配置复制到运行 master 的两个节点?此外,您是否尝试过首先在两个节点上运行主节点,然后在活动主节点上启动工作节点。请附上两个主界面的快照。
-
同时检查是否可以从两个主节点访问这些节点 - DEV-SMP-Manager01:2181DEV-SMP-Worker01:2181,DEV-SMP-Worker05:2181
标签: apache-spark apache-zookeeper high-availability