【发布时间】:2020-06-02 19:16:16
【问题描述】:
您好,我正在尝试抓取我最初使用 Bs4 的这个网站,这样可以获取某些元素。部门、名称等。但我无法使用它来获取财务数据。下面我复制了一些page_source,“-”在这种情况下应该是0.0663。我相信我正在尝试抓取 javascript,我环顾四周,但我所看到的解决方案都没有为我工作。我想知道是否有人可以帮我破解这个。
虽然如果有人可以发布一些工作代码,我将不胜感激,但如果您能指出正确的方向以及了解要在 html 中查找的内容,我也会非常感激,这向我展示了我需要做什么以及如何做得到它有点东西。
网址:https://www.tradingview.com/symbols/LSE-TSCO/
HTML:
<span class="tv-widget-fundamentals__label apply-overflow-tooltip">
Return on Equity (TTM)
</span>
<span class="tv-widget-fundamentals__value apply-overflow-tooltip">
—
</span>
Python 代码:
url = "https://www.tradingview.com/symbols/LSE-TSCO/"
options = webdriver.ChromeOptions()
options.add_argument('headless')
driver = webdriver.Chrome(ChromeDriverManager().install())
driver.get(url)
html = driver.page_source
【问题讨论】:
-
很抱歉,我们没有足够的信息来帮助您。请发帖minimal reproducible example。
-
我已经对其进行了编辑,但除了代码无法正常工作之外,我不知道该怎么做,我目前所能做的就是刮掉没有显示我需要的数字的 page_source出现为“_”所以如果我刮什么都不会返回所以网站上的代码必须像后门或类似的东西,但我不知道如何访问它,因为我是新手
标签: python-3.x selenium selenium-webdriver web-scraping beautifulsoup