【发布时间】:2018-12-01 16:56:50
【问题描述】:
我已经在我的系统中使用 maven 设置了 Kafka 和 spark 流。除了在生产者中输入内容并在消费者中看到之外,我想知道任何可以帮助我进行更广泛操作的建议。
如何创建一个源,将 json 或 avro 等数据连续放入 Kafka 生产者,这样我就可以用 spark 处理它并从中执行一些操作。需要建议我该如何设计这个
【问题讨论】:
-
向我们提供有关数据来源的更多详细信息
-
我正在考虑将源提供为 avro 或 protobuf
-
我只是把它作为一个练习。我必须自己创建一个源
-
我删除了我的答案,因为它不相关。你已经掌握了目录手表吗?这可能是一种方式
-
目录观看?我不明白你的朋友。对不起
标签: apache-spark apache-kafka spark-streaming spark-streaming-kafka