【发布时间】:2016-03-15 21:28:31
【问题描述】:
我在三个节点上使用 spark 1.2.1,这些节点运行三个具有从属配置的工作人员,并通过以下方式运行 每日 作业:
./spark-1.2.1/sbin/start-all.sh
//crontab configuration:
./spark-1.2.1/bin/spark-submit --master spark://11.11.11.11:7077 --driver-class-path home/ubuntu/spark-cassandra-connector-java-assembly-1.2.1-FAT.jar --class "$class" "$jar"
我想让 spark master 和 slave worker 始终可用,即使失败,我也需要像 service 一样重新启动它(就像 cassandra 一样) .
有什么办法吗?
编辑:
我查看了 start-all.sh 脚本,它只包含 start-master.sh 脚本和 start-slaves.sh 脚本的设置。 我试图为它创建一个 supervisor 配置文件,但只得到以下错误:
11.11.11.11: ssh: connect to host 11.11.11.12 port 22: No route to host
11.11.11.13: org.apache.spark.deploy.worker.Worker running as process 14627. Stop it first.
11.11.11.11: ssh: connect to host 11.11.11.12 port 22: No route to host
11.11.11.12: ssh: connect to host 11.11.11.13 port 22: No route to host
11.11.11.11: org.apache.spark.deploy.worker.Worker running as process 14627. Stop it first.
11.11.11.12: ssh: connect to host 11.11.11.12 port 22: No route to host
11.11.11.13: ssh: connect to host 11.11.11.13 port 22: No route to host
11.11.11.11: org.apache.spark.deploy.worker.Worker running as process 14627. Stop it first.
【问题讨论】:
-
你需要一个 mesos 或 chronos 集群,或者类似的东西
标签: apache-spark