【发布时间】:2017-02-27 00:21:59
【问题描述】:
我正在尝试创建一个 Python 脚本,以使用 BeautifulSoup 从 tcgplayer.com 提取游戏王卡的价格。当您在此网站上搜索卡片时,它会返回一个搜索结果页面,其中包含来自不同卖家的多个价格。我的目标是拉动所有这些价格。在下面的示例中,我打开了一张名为“A”细胞繁殖设备的卡片的搜索结果:
import urllib2
from bs4 import BeautifulSoup
html = urllib2.open('http://shop.tcgplayer.com/productcatalog/product/show?newSearch=false&ProductType=All&IsProductNameExact=false&ProductName=%22A%22%20Cell%20Breeding%20Device')
soup = BeautifulSoup(html, 'lxml')
soup.find_all('span', {'class': 'scActualPrice largetext pricegreen'})
几天前,正确运行soup.find_all 行为我提供了所需的信息。但是,现在运行它会给我一个空数组 []。我已经广泛搜索了关于 BeautifulSoup 返回一个空数组的信息,但我不确定它们中的任何一个是否适用于我,因为它在几天前工作得很好。有人可以帮我指出正确的方向吗?提前谢谢!
【问题讨论】:
标签: python web-scraping beautifulsoup