【发布时间】:2021-06-04 21:38:22
【问题描述】:
我想在everysize.com 网站上打印运动鞋的href Inspected website for href&class
href 位于 li class='item span3 减少 - 加载的值' 中,我尝试使用此代码打印它
import requests
from bs4 import BeautifulSoup
baseurl = 'https://www.everysize.com/'
headers = {
'User-Agent' : 'my user agent which i deleted for this'
}
r = requests.get('https://www.everysize.com/sneaker-sale/')
soup = BeautifulSoup(r.content, 'lxml')
productlist = soup.find_all('li', class_='item span3 reduced reduced--value loaded')
productlinks = []
for item in productlist:
for link in item.find_all('a', href=True):
print(link['href'])
当我尝试在终端中运行此代码时,我只收到以下消息: [Done] 在 0.775 秒内以 code=0 退出 但它应该打印出单独的hrefs?任何人都可以看到我做错了什么
【问题讨论】:
-
使用您的代码,将解析器从
lxml更改为html.parser,并将标记类更改为简单的item对我有用。
标签: python web-scraping web-scraping-language