【发布时间】:2018-04-18 11:25:23
【问题描述】:
我是一般的编码新手。简而言之,我正在使用soup.findAll('table') 函数,它会带回网页上的所有表格。当我搜索soup.findAll('table', class_='playerTable rtable') 时,它会返回[]。我知道这是正确的类名,因为我从 HTML 中复制了它。你们知道为什么会发生这种情况吗?我在这里错过了什么?
我正在尝试从http://www.spotrac.com/nfl/denver-broncos/peyton-manning-5028/ 抓取网址
你们没有看到和我同一张桌子的原因是因为你需要登录一个帐户,这需要花钱才能访问信息,我的问题仍然存在,为什么会发生这种情况?当我知道我正在寻找的班级有一张桌子时。非常感谢大家的帮助!
【问题讨论】:
-
你能发布你试图从中抓取的 URL 吗?
-
@TylerAnderson 我没有看到任何名为“playerTable rtable”的类。您能否给我一些有关您所指的物理页面部分的信息,以便我可以右键单击它并执行检查元素。
-
@TylerAnderson 我只看到一个名为“playerTable”的类
-
当然,例如,如果您右键单击表格中的任何年份,例如 2012,它会将您拉到 td 中的“a href”,它位于 tr ( SalaryRow) 在 tbody 中,它在一堆其他的东西中,但在上面是
。我想找到所有那些 playerTable rtable 的。
标签: python html python-3.x web-scraping beautifulsoup