【发布时间】:2015-07-25 21:48:49
【问题描述】:
我正在使用 Kafka-Storm 集成。 Kafka 会将数据加载到队列中,Kafka Spout 将拉取数据和进程。我有以下设计。
Kafka -> Queue -> KafkaSpout -> Process1 Bolt -> Process2 Bolt
问题是,如果 Process2 Bolt 需要更长的时间来处理数据,KafkaSpout 就会失败,并且它再次尝试从队列中读取数据,这会导致重复记录。
如果 Bolt 处理缓慢,为什么 KafkaSpout 将其视为失败?解决办法是什么?我必须在storm中设置任何超时或任何类似属性吗?
【问题讨论】:
标签: java apache-kafka apache-storm