【发布时间】:2016-04-24 00:42:12
【问题描述】:
我在玩Kafka-Connect。我有 HDFS connector 在 stand-alone mode 和 distributed mode 中工作。
他们advertise 表示可以通过YARN 管理工作人员(负责运行连接器)但是,我还没有看到任何描述如何实现此目标的文档。
如何让YARN 执行工作人员?如果没有具体方法,是否有关于如何让应用程序在 YARN 中运行的通用方法?
我已经将YARN 与使用spark-submit 的SPARK 一起使用,但是我不知道如何让连接器在YARN 中运行。
【问题讨论】:
-
你能把
package.json放到你的帖子里吗?也许它有脚本?还有你的yarn.lock -
我不确定您是否会找到很多相关信息。在不断发展的大数据技术中,Yarn 不再那么流行,许多公司宁愿投资于 Mesos 调度。无论如何,对于 Yarn 中的 Kafka Connect,我可能会尝试 slider.incubator.apache.org
-
@StephaneMartin 我已经从这个项目搬走了,但是感谢您的帖子,我会尝试检查一下...如果我这样做了,我会在这里发布我的发现...
标签: apache-kafka hadoop-yarn apache-kafka-connect