【问题标题】:BeautifulSoup cannot find data from page [duplicate]BeautifulSoup 无法从页面中找到数据 [重复]
【发布时间】:2019-02-21 17:16:30
【问题描述】:

我正在尝试使用以下代码从我的 NFL Fantasy 橄榄球联赛中提取数据

site = "http://fantasy.nfl.com/league/XXXXXXX"
req = requests.get(site)
soup = BeautifulSoup(req.text,"html5lib")
all_tables=soup.find_all('table')
all_tables

但这不会返回任何内容。我查看了变量 soup 返回的内容,并执行了 control-f 来搜索玩家姓名或统计数据,但没有运气。我查看了其他线程,阅读了一些文档,并尝试了不同的解析器,如“html.parser”、“lxml”和“xml”。但还是想不通。

难道是无法通过python查看这些数据?

【问题讨论】:

    标签: python html parsing beautifulsoup


    【解决方案1】:

    所以很可能该表是通过 javascript 加载的。所以beautifulSoup 不会上桌。我过去所做的是使用 selenium 并加载页面,然后您可以拿起加载到 javascript 的表格。我相信现在有一些库结合了 JavaScript 和 BeautifulSoup。

    也许看看这个: Parse the JavaScript returned from BeautifulSoup

    【讨论】:

    • 我走的是 Selenium 路线,到目前为止它似乎工作正常。感谢您的帮助!
    • @Jordan 我很高兴它成功了!
    猜你喜欢
    • 2015-09-30
    • 2017-10-23
    • 2014-04-18
    • 2023-04-09
    • 2020-01-27
    • 1970-01-01
    • 2018-03-13
    • 1970-01-01
    • 2019-11-12
    相关资源
    最近更新 更多