【发布时间】:2021-09-22 13:13:45
【问题描述】:
我正在尝试使用以下代码将 Yahoo Finance(https://finance.yahoo.com/world-indices/) 中的“世界指数”列表抓取到数据框中。但是,当我收到以下信息时:
ValueError: 未找到表
import pandas as pd
major_indices = pd.read_html("https://finance.yahoo.com/world-indices/")
df = pd.read_html(driver.find_element_by_id("history_table").get_attribute('outerHTML'))[0]
df.head()
Output:
ValueError: No tables found
我尝试检查页面,发现桌子被包围了
<tbody data-reactid="36"> ... </tbody>.
我试图搜索如何进行抓取,但没有任何运气。
熊猫数据阅读器是要走的路吗?有没有更强大的网络爬虫我应该使用,例如 selenium 或 beautiful soup?
【问题讨论】:
标签: python html web-scraping