【发布时间】:2015-08-01 13:39:45
【问题描述】:
我正在使用 python 以及 scrapy 和 selenium。我想从 div 类中的 h1 标签中提取文本。 例如:
<div class = "example">
<h1>
This is an example
</h1>
</div>
这是我尝试过的代码:
for single_event in range(1,length_of_alllinks):
source_link.append(alllinks[single_event])
driver.get(alllinks[single_event])
s = Selector(response)
temp = s.xpath('//div[@class="example"]//@h1').extract()
print temp
title.append(temp)
print title
每次我尝试不同的方法时,我都会得到一个空列表。
现在,我想提取“这是一个示例”,即 h1 文本并将其存储或附加到列表中,即在我的示例标题中。 像: temp = ['这是一个例子']
【问题讨论】:
标签: python selenium-webdriver web-scraping scrapy scrapy-spider