【发布时间】:2015-02-11 19:32:27
【问题描述】:
这是我从网站获取源代码的部分代码:
#Header dictionary
headers = {}
#Header for websites
headers['User-Agent'] = "Mozilla/5.0 (X11; Linux i686) AppleWebKit/537.17 (KHTML, like Gecko) Chrome/24.0.1312.27 Safari/537.17"
#Urllib code
req = urllib.request.Request(url, headers=headers)
resp = urllib.request.urlopen(req)
respData = resp.read()
这可行,但是即使我使用此程序,我的 Malwarebytes 也会阻止某些网站。有没有办法绕过这个块?
我想获取源代码并可能将其写入 txt 文件,所有这些都没有 Malwarebytes 阻止任何东西,但避免恶意内容。
【问题讨论】:
-
您应该问自己为什么要访问被反恶意软件程序阻止的网站。
-
如果您的反恶意软件程序给您带来麻烦,请禁用它。
-
@AndréDaniel 这可能是一个非常糟糕的建议
-
@yuvi 我不明白为什么会这样,因为反恶意软件可能会将域/URL 标记为恶意,因为它要么具有针对浏览器的漏洞利用,要么仅托管恶意软件文件,这些都不会针对此Python 脚本;
-
@AndréDaniel 没有关于 OP 正在使用的 url、它到达的域或脚本的其余部分正在用它做什么的足够信息(因为这显然是一个摘录),你可以'我肯定不知道