【发布时间】:2021-01-05 18:27:11
【问题描述】:
最近我开始学习使用 BeautifulSoup 进行网页抓取。我尝试从招聘网站上抓取一些信息,但我得到了一个空列表。 这是我正在使用的代码:
jobs = soup.find_all('div', class_ = 'jobsearch-SerpJobCard unifiedRow row result clickcard')
页面的 HTML 代码如下所示:
'''
div class="jobsearch-SerpJobCard unifiedRow row result clickcard" id="p_0646f3976ea7cfd6" data-jk="0646f3976ea7cfd6" data-tn-component="organicJob"
'''
请告诉我如何抓取这个标签! 提前致谢。
【问题讨论】:
-
请务必发布 HTML 文件。由于某种原因,它现在不可见。
-
是的,做出了改变
-
@VarunrajBelgaonkar:欢迎来到 SO - 更多代码将有助于重现您正在做的事情,所以请改进您的问题 - how to - minimal-reproducible-example 谢谢(网站的 URL,插件,...)
-
你能提取所有的div标签吗?
-
我猜问题是
jobsearch-SerpJobCard unifiedRow row result clickcard不是类名。有多个类:jobsearch-SerpJobCard、unifiedRow、row、result、clickcard
标签: python python-3.x list web-scraping beautifulsoup