【发布时间】:2021-09-30 11:26:54
【问题描述】:
我很感激有关使用有状态函数的一些建议。 我们目前正在使用 Flink,我们从多个 kafka 流中消费,聚合,运行计算,然后输出到一个新的流。 问题是计算元素是由一个不同的团队提供的,他们选择的语言是 Python。我们希望为他们提供独立于流媒体元素开发和更新其组件的能力。 最初,我们只是将他们的代码移植到 Java。 有状态函数似乎在这里提供了一种替代方案,我们将保留我们的一些功能,并将模型作为 Python 中的有状态函数托管。但是,我想知道,与仅将计算模块托管在自己的管道上并在 Flink 中使用 AsyncFunction 与之交互相比,这是否有任何优势。 如果我们要迁移到有状态函数,我不禁会觉得我们在不使用它的强大功能的情况下增加了复杂性,但我可能会错过一些关于速度和弹性的重要考虑因素?
【问题讨论】:
标签: apache-flink flink-streaming flink-statefun