【发布时间】:2021-08-27 14:39:25
【问题描述】:
所以我正在尝试从以下站点抓取所有可用的工作:
https://www.twitch.tv/jobs/careers/
我检查了网络设置,那里什么都没有
所以我尝试使用 xpath 提取数据,但仍然没有。
data = []
headers = {
"User-Agent": "Mozilla/5.0 (X11; Ubuntu; Linux x86_64; rv:90.0) Gecko/20100101 Firefox/90.0"
}
url = "https://www.twitch.tv/jobs/careers/"
page = requests.get(url, headers=headers)
tree = html.fromstring(page.content)
xpath = './/a/text()'
jobs = tree.xpath(xpath)
for job in jobs:
print(job)
所有返回的是
Job Openings
Early Career
Equity & Inclusion
Blog
twitch.tv
Job Openings
Early Career
Equity & Inclusion
Blog
....................................
....................................
....................................
Stream
Watch
Develop
Advertise
twitch.tv
Jobs
Merch
Brand
TwitchCon
Meetups
News
Press
Bits
Subs
Turbo
Prime
Extensions
Sings
Legal
Help Center
Security
Twitter
Facebook
Instagram
Terms of service
Privacy Policy
Ad Choices
Cookie Policy
Partners
Affiliates
【问题讨论】:
标签: web-scraping xpath python-requests