【发布时间】:2019-01-26 19:23:53
【问题描述】:
我正在尝试生成流数据,以模拟我在不同的时间范围内接收到两个值(整数类型)、时间戳和 Kafka 作为连接器的情况。
我使用 Flink 环境作为消费者,但我不知道哪个是生产者的最佳解决方案。 (如果可能,Java 语法比 Scala 更好)
我应该直接从 Kafka 生成数据吗?如果是,最好的方法是什么? 或者,如果我作为生产者从 Flink 生成数据,将其发送到 Kafka 并在最后由 Flink 再次使用它,也许会更好?我怎么能从 flink 做到这一点? 或者也许还有另一种简单的方法来生成流数据并将其传递给 Kafka。
如果是,请让我走上实现它的轨道。
【问题讨论】:
-
视情况而定。你在测试架构吗?你想生成特定的数据吗?生产率重要吗?你能提供更多关于你想做什么的信息吗?如果您只想生成数据,您可能需要使用 Kafka Producer API 和 Java 线程创建一个 Java 类,并开始尽可能多地生成数据。
-
感谢大卫的回答。假设我有 2000 个用户,他们在 2 周内每天 4 次生成 2 个值,整数(例如 (3.001, 2.434))。 2 周后,数据将在 6 个月内每天只显示一次,而不是 4 次。我会将这些数据用于 CEP Flink API。但这是我第一次生成流数据。我将检查 Kafka Producer API。
-
你可以使用 ksql-datagen docs.confluent.io/current/ksql/docs/tutorials/…
标签: java apache-kafka apache-flink stream-processing event-stream-processing