【发布时间】:2020-03-28 05:15:08
【问题描述】:
我正在尝试使用 BeautifulSoup 从包含品牌、产品名称、价格等的产品详细信息页面下方获取容器。
根据 chrome 站点检查,它是“product-detail__info”类中的“div”容器(请参见屏幕截图)
不幸的是我的代码确实有效...
如果有人能给我小费,我将不胜感激:)
提前致谢
链接:https://www.nemlig.com/opvasketabs-all-in-one-5039333
from urllib.request import urlopen as uReq
from bs4 import BeautifulSoup as soup
my_url = "https://www.nemlig.com/opvasketabs-all-in-one-5039333"
#Opening connection and grabbing the page
uClient = uReq(my_url)
page_html = uClient.read()
#Closing connection
uClient.close()
#html parsing
page_soup = soup(page_html, "html.parser")
#grabs product detail container
container = page_soup.find_all("div", {"class": "product-detail__info"})
print(container)
【问题讨论】:
-
页面是动态的。要么从请求中获取数据以获取该信息,要么使用 Selenium 首先呈现页面
标签: python web-scraping beautifulsoup