【发布时间】:2014-02-10 03:45:10
【问题描述】:
import urllib2
import time
def hunt(url, start="<blockquote>", end="</blockquote>"):
while 1:
x = urllib2.urlopen(url)
y = x.read()
print y[y.find(start):y.find(end)]
time.sleep(1)
我正在尝试不断更新网页上的单个元素,包括避免被服务器禁止的时间间隔。它不一定是 python,顺便说一句。
【问题讨论】:
-
如果服务器只允许你每隔一段时间运行一次,它到底需要多快?
-
我会尝试找出服务器的速率限制,但在客户端我也想更快地进行解析。我的意思是像华尔街一样快。
-
网站有 API 吗?或许不用拉整个页面也能拿到值。
标签: python web-scraping webpage performance processing-efficiency