【发布时间】:2020-02-21 17:02:18
【问题描述】:
我正在使用 BeautifulSoup 在职业页面上抓取职位列表。我无法打印出我需要的信息。
这是 HTML 的样子
<ul class="list-group">
<li class="list-group-item">
<h4 class="list-group-item-heading">
<a href="http://careers.steelseries.com/apply/3LXwyjYOrb/Customer-Experience-Specialist">
Customer Experience Specialist </a>
</h4>
<ul class="list-inline list-group-item-text">
<li><i class="fa fa-map-marker"></i>Chicago, IL</li>
<li><i class="fa fa-sitemap"></i>Operations</li>
</ul>
我希望它打印出来的是
Customer Experience Specialist
Chicago, IL
Operations
--------------
我试过的代码是这样的:
section = soup.find_all('div', class_='col col-xs-7 jobs-list')
for elem in section:
wrappers = elem.find('ul').get_text()
print(wrappers)
但是这样做是用太多的新行和空格为我打印它:
Customer Experience Specialist
Chicago, IL
Operations
请记住,职位上方还有 4 个空行,“操作”之后还有一个新行
【问题讨论】:
标签: python html web-scraping beautifulsoup