【发布时间】:2018-09-18 00:29:39
【问题描述】:
我正在从网络上抓取一些数据,由于我应该获取的数据非常庞大,因此我同时收到了 500 多个请求(通过urllib.request.urlopen(url) 通过multiprocessing 汇集)。
这里的问题是抛出如下错误:
urllib.error.URLError: urlopen 错误名称暂时失败 分辨率
经过一番研究,我发现这个问题是由于请求过多时无法关闭连接造成的。但是还没有找到解决这个问题的方法。
我应该将同时连接限制在某个安全范围内,还是更改urllib 请求配置?
开发环境:
- Ubuntu 16.04
- Python 3.6
【问题讨论】:
标签: python web-crawler urllib