【发布时间】:2021-05-13 11:25:05
【问题描述】:
我试图抓取https://www.etf.com/KJUL 以获取页面上的表格>
我用python写了代码。
-
from selenium import webdriver
from selenium.webdriver.common.keys import Keys
path = "C:\Program Files (x86)\chromedriver.exe"
driver =webdriver.Chrome(path)
url ="https://www.etf.com/KJUL#overview"
driver.get("https://www.etf.com/KJUL")
print(driver.page_source)
search =driver.find_elements_by_tag_name("rowText")
我无法从解析的内容中获取任何内容,因为我无法获取与表格相关的任何标签。我怎样才能拿到桌子?
【问题讨论】:
-
目标页面严重依赖 JavaScript 来填充其内容,包括您尝试定位的内容。 BeautifulSoup 是一个 HTML 解析器,不评估 JavaScript。检查
r的内容,这将证实这一点。使用 Selenium 或 Puppeteer 之类的浏览器控制实用程序,它会像您自己的浏览器一样评估页面上的 JavaScript。 -
你到底想要哪张桌子?
-
@baduker KJUL 汇总表如图所示