【发布时间】:2012-09-07 13:07:30
【问题描述】:
我在 Heroku dyno 上运行 celeryd。当我关闭它并且它之前已经处理(甚至完成)了至少一项任务时,它没有正确关闭并且我从 Heroku 收到错误 R12(退出超时)。
这是我从 Procfile 运行 celeryd 的方式(通过 Django 和 django-celery):
celeryd: python manage.py celeryd -E --loglevel=INFO
这是触发它的方法:
> heroku ps:scale web=0 celeryd=0 --app myapp
这是我得到的日志输出:
2012-09-07T12:56:31+00:00 heroku[celeryd.1]: State changed from up to down
2012-09-07T12:56:31+00:00 heroku[api]: Scale to celeryd=0, web=1 by mail@mydomain.com
2012-09-07T12:56:32+00:00 heroku[web.1]: State changed from up to down
2012-09-07T12:56:32+00:00 heroku[api]: Scale to web=0 by mail@mydomain.com
2012-09-07T12:56:34+00:00 heroku[celeryd.1]: Stopping all processes with SIGTERM
2012-09-07T12:56:35+00:00 heroku[web.1]: Stopping all processes with SIGTERM
2012-09-07T12:56:37+00:00 heroku[web.1]: Process exited with status 143
2012-09-07T12:56:43+00:00 heroku[celeryd.1]: Error R12 (Exit timeout) -> At least one process failed to exit within 10 seconds of SIGTERM
2012-09-07T12:56:43+00:00 heroku[celeryd.1]: Stopping remaining processes with SIGKILL
2012-09-07T12:56:45+00:00 heroku[celeryd.1]: Process exited with status 137
最初,我在 celery 2.5.5 上遇到过这种情况。现在升级到 3.0.9 还是一样的问题。
据我所知,我的任务已经全部完成。通过在 celery dyno 上运行单个任务,给它足够的时间来完成然后关闭 dyno,这个错误可以可靠地重现。
我不知道还要检查什么。知道如何解决这个问题吗?当任务已经完成时,什么会阻止 celeryd 响应 Heroku 的 SIGTERM?
【问题讨论】:
-
最终解决了这个问题?我遇到了同样的问题。
-
@Murph 我从来没有弄清楚,但我也无法再复制它。但是,我现在正在运行一个完全不同的配置,使用最新的 celery 和 django-celery 以及更复杂的 Procfile,多个工作人员的单独进程、cam 和 beat 在同一个 dyno 上。
-
我也被这个问题困住了,请参阅github.com/yuvadm/heroku-periodical/issues/1
-
我仍然/再次在 celery 3.1.11 上遇到这个问题。不幸的是没有解决。 :(
标签: heroku celery django-celery celeryd