【发布时间】:2016-07-16 20:06:54
【问题描述】:
我开始在一个小项目中使用 Scrapy,但无法提取链接。每次找到该类时,我只得到“[]”而不是 url。我错过了什么明显的东西吗?
sel = Selector(response)
for entry in sel.xpath("//div[@class='recipe-description']"):
print entry.xpath('href').extract()
来自网站的示例:
<div class="recipe-description">
<a href="http://www.url.com/">
<h2 class="rows-2"><span>SomeText</span></h2>
</a>
</div>
【问题讨论】:
-
我认为您的 xpath 查询是错误的。您必须选择链接,然后获取 href 属性。像这样://a[@href]
标签: python web-scraping scrapy