【发布时间】:2019-06-20 08:14:38
【问题描述】:
我正在尝试同时从网页中抓取 2 个表格。 BeautifulSoup 找到第一个表没有问题,但无论我尝试什么都找不到第二个表,这是网页:Hockey Reference: Justin Abdelkader。
这是季后赛标题下方的表格。
这是我的代码。
sauce = urllib.request.urlopen('https://www.hockey-reference.com/players/a/abdelju01/gamelog/2014', timeout=None).read()
soup = bs.BeautifulSoup(sauce, 'html5lib')
table = soup.find_all('table')
print(len(table))
总是打印 1。
如果我打印(汤),并在终端中使用搜索功能,我可以找到 2 个单独的表格标签。我没有看到任何会阻碍 BS4 查找标签的 javascript。我也尝试通过 id 和 class 查找表,即使表的父 div 似乎也无法找到。有谁知道我做错了什么?
【问题讨论】:
-
大声笑...我不久前也问过同样的问题(但针对的是 football-reference.com 网站)。这是解决方案:stackoverflow.com/questions/47433490/…
标签: python pandas beautifulsoup