【发布时间】:2014-03-04 16:09:13
【问题描述】:
我正在尝试通过打开此 url https://www.google.com/search?q=define+<something> 并解析定义的源来使用 Google 和 urllib2 获取单词的定义。但是,当我尝试访问该页面时,我得到一个 403 错误,据说是为了防止以这种方式进行数据挖掘。我相当肯定尝试绕过它是不明智的,所以我想知道是否有替代方法可以从 Google 的服务器访问数据,或者我应该使用数据转储。
编辑:这是我用来访问 URL 的代码范围;
url = "https://www.google.com/search?q=define+" + word
try:
source = ulib.urlopen(url)
except ulib.HTTPError, e:
print e.fp.read()
【问题讨论】:
-
我们需要检查您正在使用的代码以了解问题所在。在 Chrome 上使用带有某个值的特定 URL 的测试确实允许访问。
标签: python dictionary urllib2 webpage access-denied