【发布时间】:2021-11-06 03:28:13
【问题描述】:
我在 python 上使用 BeautifulSoup 从这个网站上抓取足球统计数据:https://www.skysports.com/premier-league-results/2020-21。然而,该网站只显示了本赛季的前 200 场比赛,其余 180 场比赛都在“显示更多”按钮后面。按钮不会更改 url,所以我不能只替换 url。
这是我的代码:
from bs4 import BeautifulSoup
import requests
scores_html_text = requests.get('https://www.skysports.com/premier-league-results/2020-21').text
scores_soup = BeautifulSoup(scores_html_text, 'lxml')
fixtures = scores_soup.find_all('div', class_ = 'fixres__item')
这只会获得前 200 个灯具。
如何通过显示更多按钮访问 html?
【问题讨论】:
-
你可以试试 Selenium。铬驱动有无头模式,所以你可以找到按钮并点击它!
标签: python web-scraping beautifulsoup