【问题标题】:Getting a None or empty list after scraping info [closed]抓取信息后获取无或空列表[关闭]
【发布时间】:2021-01-05 18:27:11
【问题描述】:

最近我开始学习使用 BeautifulSoup 进行网页抓取。我尝试从招聘网站上抓取一些信息,但我得到了一个空列表。 这是我正在使用的代码:

jobs = soup.find_all('div', class_ = 'jobsearch-SerpJobCard unifiedRow row result clickcard')

页面的 HTML 代码如下所示:

'''

div class="jobsearch-SerpJobCard unifiedRow row result clickcard" id="p_0646f3976ea7cfd6" data-jk="0646f3976ea7cfd6" data-tn-component="organicJob"

'''

请告诉我如何抓取这个标签! 提前致谢。

【问题讨论】:

  • 请务必发布 HTML 文件。由于某种原因,它现在不可见。
  • 是的,做出了改变
  • @VarunrajBelgaonkar:欢迎来到 SO - 更多代码将有助于重现您正在做的事情,所以请改进您的问题 - how to - minimal-reproducible-example 谢谢(网站的 URL,插件,...)
  • 你能提取所有的div标签吗?
  • 我猜问题是jobsearch-SerpJobCard unifiedRow row result clickcard 不是类名。有多个类:jobsearch-SerpJobCardunifiedRowrowresultclickcard

标签: python python-3.x list web-scraping beautifulsoup


【解决方案1】:

尝试使用:

jobs=soup.find_all("div", ["jobsearch-SerpJobCard","unifiedRow","row","result","clickcard"])

jobs=find_all("div", class_=['jobsearch-SerpJobCard','unifiedRow','row','result','clickcard'])

【讨论】:

  • 这是猜测,问题没有包含足够的信息来重现问题。
  • 是的,在这一点上我只是假设。你是对的
  • @SreeramM 是的,使用该代码可以提取所有 div 标签!
猜你喜欢
  • 1970-01-01
  • 2019-07-16
  • 2013-10-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2020-04-03
  • 1970-01-01
相关资源
最近更新 更多