【发布时间】:2019-10-26 18:55:39
【问题描述】:
我是 Scrapy 的新手,正在尝试使用该框架。真正令人沮丧的是,当我运行“scrapy crawl (name of spider)”时,它会运行我的“spiders”文件夹中的每一个蜘蛛。所以我要么必须等待所有的蜘蛛都在运行,要么注释掉所有的蜘蛛,除了我正在使用的蜘蛛。这很烦人。我怎样才能让scrapy一次只运行一个蜘蛛?
【问题讨论】:
-
你给你所有的蜘蛛都取了同一个名字(
SpiderClass.name中定义的那个)?调用scrapy crawl spider_name不应同时运行多个蜘蛛。 -
不,这就是奇怪的原因。它们的名称都不同。我检查了我的设置文件并试图查看我是否以错误的方式设置了一些东西,但我没有看到任何奇怪的东西。
标签: python-3.x web-scraping scrapy