【发布时间】:2018-02-27 22:43:37
【问题描述】:
我正在使用 Python 和 Beautiful Soup 从 Steam (http://store.steampowered.com/tags/en-us/RPG/) 中删除 20 款游戏的列表。但是这些游戏不是用div 分隔的,而是用a 标记。因此,我尝试执行以下操作:
all_games=soup.find_all('a',{'class':'tab_item app_impression_tracked'})
(那些空格存在于 Steam 的 HTML 中)
但是,它返回了一个空列表,而不是所有包含名为 tab_item app_impression_tracked 的“类”的 a 标记
我不想只删除游戏的名称,还有它的价格、折扣……而且我对链接也不感兴趣。我只想获取a 标签,因为它包含我需要的有关游戏的所有信息。
有解决办法吗?
解决方案:
all_games = soup.find('div', {'id':'NewReleasesRows'}).find_all('a', {'class':'tab_item'})
那些空格是有问题的,班级的真实名称是tab_item,而不是我想的tab_item app_impression_tracked。
【问题讨论】:
-
这里回答了类似的问题stackoverflow.com/a/1080472/6158987
-
您只需要游戏名称吗?
标签: python web-scraping beautifulsoup