【发布时间】:2021-08-15 00:13:48
【问题描述】:
所以,
假设我在谷歌搜索“白俄罗斯”,一旦我们这样做,我们就会收到一些模型卡,如下图所示,
现在,如果您查看 HTML 的 Inspector,我们将看到这些卡片的 HREF 在锚标记内,就像下图一样,(...表示额外的东西)
<a class="a-no-hover-decoration" href="https://www.liquor.com/recipes/white-russian/" .....>
所以,我感兴趣的是从此类锚标记中提取该 href(如果它们存在用于搜索)。
我的尝试,
import requests
from bs4 import BeautifulSoup
req = requests.get("https://www.google.com/search?q=White+Russian")
soup = BeautifulSoup(req.text, 'html.parser')
soup.find_all("a", {"class": "a-no-hover-detection"}) # this returns Nothing
我对 web-scraping 有点陌生,所以非常感谢您的帮助。
我的第二个问题是,对于任何给定的随机搜索,如何检测我们有这样的模型卡与没有这样的卡?
谢谢。
【问题讨论】:
标签: python html css web-scraping beautifulsoup