【发布时间】:2017-09-05 19:09:00
【问题描述】:
以下内容适用于 99.999% 的网站,但随机找到一个不适用的网站:
import requests
requests.get('http://arboleascity.com',timeout=(5,5),verify=False)
我已就该项目提出问题。
https://github.com/requests/requests/issues/4276
有什么建议或想法吗?
我在concurrent.futures.ThreadPoolExecutor 中运行它,所以我真的不想添加一些外部的东西,比如小事件或信号。但对任何运作良好的东西都持开放态度。
【问题讨论】:
-
页面是否非常/无限长?
-
去吧,我看不出这个网站有什么问题。加载速度超快、内容相当小的内容。
-
卷曲它,我永远看不到它结束。看起来页面以 8 kBps 无休止地传输
-
如果您是“随机查找”网站,如果您根本不知道要下载什么样的数据,您可能需要更多的遏制措施。
标签: python python-3.x python-requests