【发布时间】:2017-05-05 11:14:51
【问题描述】:
我喜欢 urllib 模块,我用它来使用 Python 2.7 进行大量、持续的数据检索。就这样……
import urllib
urllib.urlretrieve("http://www.example.com/mirror_me.txt","mirror_me.txt")
我正在镜像的服务对我可以访问他们的服务的频率有非常严格的规定。当我点击时,它几乎总是 200 响应,但有时我需要注意 404,因为它们有时会出现错误的进程。
我知道我可以通过这种方式检查响应代码...
a=urllib.urlopen('http://www.example.com/mirror_me.txt')
a.getcode()
200
问题是我不知道如何将两者结合起来,所以现在我不得不发送两个效率低下的请求,而且我对他们的服务器的命中率加倍。 理想情况下,我想要以下.....
if 200:
mirror
elif 404:
notify me....
也许我的答案不在 urllib 中,但我感谢任何人的指点。 JW
【问题讨论】:
标签: python python-2.7 python-requests urllib mirror