【发布时间】:2020-06-08 12:54:29
【问题描述】:
基本上,我有一个工作版本的中间件可以通过 selenium 传递所有请求并返回 HtmlResponse,问题是我还希望将一些元数据附加到我可以在蜘蛛的解析方法中访问的请求中。由于某种原因,我无法在蜘蛛的解析方法中访问它,请您帮帮我吗?
中间件.py
def process_request(self, request, spider):
request = request.replace(meta={'test': 'test'})
self.driver.get(request.url)
body = self.driver.page_source
return HtmlResponse(self.driver.current_url, body=body, encoding='utf-8', request=request)
蜘蛛.py
def parse(self, response):
yield {'meta': response.meta}
【问题讨论】:
标签: web-scraping scrapy scrapy-middleware