【发布时间】:2016-09-10 20:48:29
【问题描述】:
我正在使用scrapy。我想根据每个请求轮换代理,并从我拥有的返回单个代理的 api 获取代理。我的计划是向api发出请求,获取代理,然后使用它来设置代理:
http://stackoverflow.com/questions/4710483/scrapy-and-proxies
我将在哪里分配它:
request.meta['proxy'] = 'your.proxy.address';
我有以下几点:
class ContactSpider(Spider):
name = "contact"
def parse(self, response):
for i in range(1,3,1):
PR= Request('htp//myproxyapi.com', headers= self.headers)
newrequest= Request('htp//sitetoscrape.com', headers= self.headers)
newrequest.meta['proxy'] = PR
但我不确定如何使用 Scrapy Request 对象来执行 api 调用。调试时我没有收到对 PR 请求的响应。我需要在单独的函数中执行此操作并使用 yield 语句还是我的方法错误?
【问题讨论】: