【发布时间】:2019-04-18 16:52:26
【问题描述】:
我正在抓取电子商务网站,并抓取了多个类别,但其中一些产生了结果,但一些链接得到了错误:蜘蛛错误处理...请帮助我如何对其进行排序...
【问题讨论】:
-
请尽量将有助于解决您的问题的最少代码与您的问题放在一起,而不是发布代码的图像。
-
他们没有让我上传我的代码...顺便说一句,我正在抓取一个网站,根据 url 请求具有元“类别”的网站的不同 url...但是一些返回结果和一些给予处理错误...请检查图片中的代码
-
Samsung_Tablets = response.urljoin("prices/tablets/samsung") yield scrapy.Request(Samsung_Tablets, callback = self.parse_products, meta = {'category' : 'Tablets','subcategory' : '三星', '品牌': '三星'}, dont_filter=True)
-
INFO:爬取 27 页(14 页/分钟),抓取 282 项(194 项/分钟)2019-04-18 21:31:50 [scrapy.core.engine] 调试:爬取 (200)
shophive.com/catalogsearch/result/index/…> (referer: shophive.com/catalogsearch/result/?q=+mobile+phones+onepl) 2019-04-18 21:31:50 [scrapy.core.scraper] ERROR: Spider error processing shophive.com/catalogsearch/result/index/…> (referer: @987654327 @) -
欢迎来到 Stackoverflow。请花一些时间阅读本指南:How to create a Minimal, Complete, and Verifiable example
标签: python parsing request scrapy web-crawler