【发布时间】:2019-08-11 14:50:48
【问题描述】:
我正在尝试根据卖家名称在亚马逊上收集前两页产品名称。当我请求页面时,它包含我需要的所有元素,但是,当我使用 BeautifulSoup 时 - 它们没有被列出。这是我的代码:
import requests
from bs4 import BeautifulSoup
headers = {'User-Agent':'Mozilla/5.0'}
res = requests.get("https://www.amazon.com/s?me=A3WE363L17WQR&marketplaceID=ATVPDKIKX0DER", headers=headers)
#print(res.text)
soup = BeautifulSoup(res.text, "html.parser")
soup.find_all("a",href=True)
产品链接未列出。如果 Amazon API 提供了这些信息,我愿意使用它(请提供一些使用示例)。提前非常感谢。
【问题讨论】:
-
你能提供一些关于你所看到的和你期望看到的细节吗?
-
它们可能是动态加载的,需要像 selenium 这样的方法
-
@QHarr 这就是我一开始的想法,但它们出现在
res.text中,这很奇怪!但不存在于汤中 -
@EliotK 我想要的是获得
res.text中存在的产品标题(名称),如问题所述,但不在汤中 -
例如将是 Elsey 博士的 Cat Ultra Premium 结块猫砂(包装可能不同)?
标签: python web-scraping beautifulsoup