【发布时间】:2018-10-20 14:21:44
【问题描述】:
我从 5 月 1 日开始使用 kafka s3 sink 连接器(confluent 包中的捆绑连接器)。它工作正常,直到 5 月 8 日。检查状态,它告诉某些 aws 异常使此连接器崩溃。这应该不是什么大问题,所以我想恢复它。
我尝试了以下步骤:
- 我发布 /connectors/s3sink/restart 。然后我看到连接器处于 RUNNING 模式,但任务仍然失败。
- 然后我 PUT /connectors/s3sink/task/0/restart。好的,现在任务处于 RUNNING 模式。
但是后来我跟踪日志,我发现它开始重写旧数据,比如5月3日的数据。它弄乱了旧数据!
那么,connect restart REST API 是否会重置偏移量?我以为它会保存偏移量,然后从失败的偏移量开始。
以及如何正确重启失败的连接器任务?通过删除那些 POD? (使用 kubernetes),还是通过 REST /task/0/restart?我应该什么时候使用 /connectors/s3sink/restart?
【问题讨论】:
标签: amazon-s3 apache-kafka apache-kafka-connect confluent-platform