【发布时间】:2018-01-02 08:36:50
【问题描述】:
我正在尝试从 offerup.com 上抓取一些信息,但在 scrapy shell 上,什么也没有出现。
我会输入:
scrapy shell https://offerup.com/
它会去那里,但如果我只是尝试获取整个网页的文本:
response.xpath('//text()').extract()
它回来了:
['Request unsuccessful. Incapsula incident ID: 623000250007296502-10946686267359632']
对于我尝试获取的任何其他信息(例如标题),它一无所有。
你知道为什么会这样吗?非常感谢任何帮助。
【问题讨论】:
-
请发布您正在使用的完整代码行。
-
如果您找到绕过 403 的方法,请告诉我们!
-
@Naltroc 这实际上是一个非常容易解决的问题。您需要做的就是将用户代理更改为普通浏览器!感谢您的帮助!
标签: python http web-scraping scrapy scrapy-spider