【发布时间】:2016-07-29 12:24:45
【问题描述】:
我对scrapy有点陌生,但我被困在了一个点上。我想在蜘蛛关闭时重新启动它。
我在这里尝试实现的是我从数据库中获取 URL,我以一种方式编写视图,每当我发送“scrapy crawl xyz”请求时,start_request 都会得到一个 URL[next URL],即不同于从数据库的上一个请求中传递的内容。
问题是如果数据库中有四个 URL,我需要运行 4 次“scrapy crawl xyz”,但我想避免这种情况,并且我试图在当前的“spider_closed”被调用时触发“scrapy crawl xyz”在蜘蛛的尽头。请帮忙
【问题讨论】:
标签: scrapy web-crawler