【发布时间】:2019-08-29 04:50:06
【问题描述】:
我正在尝试从雅虎财经中提取股票的实时价格数据。此信息包含在带有“class”和“data-reactid”的“span”标签中。我无法从这个 span 标签中提取信息。
当我输入我的代码时,我没有得到任何输出,也没有得到任何错误。
我已经尝试了这个问题的几乎所有其他答案,但没有一个对我有用。
<--HTML Code-->
<span class="Trsdu(0.3s) Fw(b) Fz(36px) Mb(-4px) D(ib)" data-reactid="34">197.00</span>
#Python Script
my_url = "https://finance.yahoo.com/quote/AAPL?p=AAPL&.tsrc=fin-srch"
u_client = u_req(my_url)
page_html = u_client.read()
u_client.close()
page_soup = soup(page_html, "html.parser")
container = page_soup.find('span', {"data-reactid":'34'})
我想得到“197.00”(股票的实时价格)的输出作为输出。
【问题讨论】:
-
什么是
u_req? -
@gmds 我认为来自
from urllib.request import urlopen as u_req -
@Kush G。我认为这是因为输出是用 JavaScript 呈现的。所以你需要
selenium而不是BeautifulSoup
标签: python html python-3.x web-scraping beautifulsoup