【发布时间】:2019-02-02 02:32:46
【问题描述】:
我正在尝试从这个list 中抓取美国排名前 100 的职位。当我运行这段代码时:
import urllib.request
from bs4 import BeautifulSoup
url = 'https://www.ranker.com/list/most-common-jobs-in-america/american-jobs'
page_opened = urllib.request.urlopen(url)
soup = BeautifulSoup(page_opened, 'html.parser')
jobs_soup = soup.find_all('span','listItem__title')
print(jobs_soup)
Beautiful Soup 返回了我所期望的结果,职位名称被标签包围,但它只属于“中学教师”,在 100 个职位中仅排名第 25。我在其他网页上以同样的方式使用 Beautiful Soup 没有问题。网页/我的代码有什么奇怪的地方导致输出不完整吗?
【问题讨论】:
标签: python web-scraping beautifulsoup