【问题标题】:Requests HTTP Error 403: Forbidden. How to fix it?请求 HTTP 错误 403:禁止。如何解决?
【发布时间】:2022-01-06 16:02:45
【问题描述】:

我需要从 div 中提取数据,但我有一些问题 这是我的代码:

import urllib.request as urllib2
from bs4 import BeautifulSoup
import requests
url = 'https://ru.investing.com/crypto/bitcoin/btc-usd-technical'
headers={'User-Agent': 'Mozilla/5.0'}
req = requests.get(url=url, headers=headers)
soup = BeautifulSoup(urllib2.urlopen("https://ru.investing.com/crypto/bitcoin/btc-usd-technical"), 'html', req)
result = soup.find_all("div", {"class":"summary"})

print(result)

这是我得到的错误:

raise HTTPError(req.full_url, code, msg, hdrs, fp)
urllib.error.HTTPError: HTTP Error 403: Forbidden

【问题讨论】:

标签: python python-requests


【解决方案1】:

这个错误不是关于 BeautifulSoup,而是关于 urllib。 HTTP 403 响应代码意味着服务端不允许您访问页面或网站。也许这是因为您发送了太多请求,或者您正试图访问一个特殊的网页(如管理面板或其他东西)。另外,我建议您使用 requests 库,然后使用 urllib3。也许至少你应该使用 urllib3,我猜。

【讨论】:

    猜你喜欢
    • 2016-10-15
    • 2020-05-01
    • 2016-06-19
    • 2019-12-27
    • 1970-01-01
    • 1970-01-01
    • 2015-11-29
    • 1970-01-01
    • 2011-07-12
    相关资源
    最近更新 更多