【发布时间】:2020-09-11 17:46:45
【问题描述】:
我想使用其他方法而不是使用 meta,因为 meta 当前用于处理我的蜘蛛中的 302 响应。当我在此字典中添加额外的项目以同步数据时,302 响应被忽略
def start_requests(self):
for url in urls:
self.rowExt = row
yield scrapy.Request(
url=url, callback=self.parse, dont_filter=True,
meta={
'dont_redirect': True,
'handle_httpstatus_list': [302],
}
)
如果我在此字典中添加任何额外的项目,302 响应处理将不起作用。
def start_requests(self):
for url in urls:
self.rowExt = row
yield scrapy.Request(
url=url, callback=self.parse, dont_filter=True,
meta={
'dont_redirect': True,
'handle_httpstatus_list': [302],
'Name': name,
'Price': price,
}
)
【问题讨论】:
标签: python web-scraping scrapy web-crawler