【发布时间】:2021-08-28 19:47:53
【问题描述】:
我想从此页面“https://m.aiscore.com/basketball/20210610”中抓取所有匹配项链接,但只能获得有限数量的匹配项: 我试过这段代码:
import requests
from bs4 import BeautifulSoup
from selenium import webdriver
from selenium.webdriver.chrome.options import Options
options = Options()
options.add_argument("--headless")
driver = webdriver.Chrome(executable_path=r"C:/chromedriver.exe", options=options)
url = 'https://m.aiscore.com/basketball/20210610'
driver.get(url)
driver.maximize_window()
driver.implicitly_wait(60)
driver.execute_script("window.scrollTo(0, document.body.scrollHeight)")
soup = BeautifulSoup(driver.page_source, 'html.parser')
links = [i['href'] for i in soup.select('.w100.flex a')]
links_length = len(links) #always return 16
driver.quit()
当我运行代码时,我总是只得到 16 个匹配的链接,但页面有 35 个匹配。 我需要获取页面中的所有匹配链接。
【问题讨论】:
-
您在我的 ubuntu 机器中的代码运行良好(我只更改了 chrome 可执行路径)。你用的是什么版本的chromedriver?
-
我使用的是 91 版
-
您要我给您获取该页面上所有链接的代码吗?
标签: python selenium-webdriver web-scraping beautifulsoup