【发布时间】:2021-08-30 17:03:18
【问题描述】:
使用漂亮的汤和请求库抓取带有大量 html 标签的大型网站(如 Facebook 或 twitter)时出现问题。
from bs4 import BeautifulSoup
import requests
html_text = requests.get('https://twitter.com/elonmusk').text
soup = BeautifulSoup(html_text, 'lxml')
elon_tweet = soup.find_all('span', class_='css-901oao css-16my406 r-poiln3 r-bcqeeo r-qvutc0')
print(elon_tweet)
The tweet and its corresponding span
全幅图像
当代码执行时,这将返回一个空列表。
我是网络抓取的新手,欢迎详细解释。
【问题讨论】:
标签: python beautifulsoup python-requests