【发布时间】:2020-02-05 18:38:39
【问题描述】:
我正在尝试使用 selenium 和 BeautifulSoup 从网页 (https://en.wikipedia.org/wiki/2018%E2%80%9319_Premier_League) 中提取一个表格。
但我被解析表困住了。 我只想要网页中的一张表,即“联赛表”,但无论我尝试过什么,都会收到错误消息。
这是我尝试过的代码。
import selenium
from bs4 import BeautifulSoup
from selenium import webdriver
import time
driver.get("https://google.com")
elem = driver.find_element_by_xpath('//*[@id="tsf"]/div[2]/div[1]/div[1]/div/div[2]/input')
elem.send_keys("2018 epl")
elem.submit()
try:
print(driver.title)
driver.find_element_by_partial_link_text("Wikipedia").click()
website = requests.get(driver.current_url).text
soup = BeautifulSoup(website, 'html.parser')
然后我遇到了麻烦.. 我已经尝试了几个代码,其中一个如下。
rows=soup.find_all('td')
那么你能帮我完成我的代码吗? 非常感谢。
【问题讨论】:
-
您收到的错误信息是什么?
-
您提到了维基百科页面问题,但您的代码与谷歌搜索更相关。您能否提供一个相关示例,直接指向您提到的页面并尝试解析表格?
标签: python selenium parsing web-scraping beautifulsoup