【发布时间】:2019-02-18 22:57:21
【问题描述】:
我是 python/scrapy 的新手。我的问题与此问题类似,但我无法制定一个有效的答案:
How Scrapy extract text inside class that inside attribute?
这是我的代码:
import scrapy
class IndeedSpider(scrapy.Spider):
name='indeed_jobs'
start_urls = ['https://www.indeed.com/q-Software-Engineer-l-Portland,-OR-jobs.html']
def parse(self, response):
next_page_outer = './/link[@rel="next"]'
next_page_url_outer = response.xpath(next_page_outer).get()
print(next_page_url_outer)
该代码产生:
<link rel="next" href="/jobs?q=Software+Engineer&l=Portland%2C+OR&start=10">
如何从包含在此响应中的 href 中获取文本?谢谢!
【问题讨论】: