【发布时间】:2018-05-15 14:44:56
【问题描述】:
我正在尝试自动下载出现在 google 图片搜索中的第一张图片,但我无法读取网站源代码并出现错误(“HTTP 错误 403:禁止访问”)。 有任何想法吗?谢谢您的帮助!
这是我的代码:
from urllib.request import urlopen
from bs4 import BeautifulSoup
word = 'house'
r = urlopen('https://www.google.pl/search?&dcr=0&tbm=isch&q='+word)
data = r.read()
【问题讨论】:
-
也许谷歌不喜欢
urlopen()发送的默认用户代理
标签: python