【发布时间】:2017-09-19 18:09:37
【问题描述】:
我正在开发一个 spark 程序来监控每个执行器的性能,例如当一个执行器开始工作和完成工作时标记下来。我正在考虑两种方法:
首先,开发程序,当执行器开始工作时,它将当前时间标记到一个文件中,当它完成时,将该时间标记到同一个文件中。最后,除了驱动机器之外,所有的“日志”文件都会传播到整个集群网络。
其次,由于executors会定期向driver报告,每次driver收到executors的消息,如果消息中包含“start”和“finish”信息,让driver记录一切。
这可能吗?
【问题讨论】:
-
Spark 日志系统已经这样做了。
-
在这里看到这些东西。 Spark 已经有了类似的东西:spark.apache.org/docs/latest/monitoring.html
标签: hadoop apache-spark driver executor bigdata