【发布时间】:2015-03-12 11:36:43
【问题描述】:
我正在使用scrapy + python。我试图从job url中提取jobid数据,任何人都可以指导我提取这个数据。
http://xxxxx/apply/EkhIMG/Director-Financial-Planning-Analysis.html
我要单独提取这个内容“Director-Financial-Planning-Analysis”
还需要去掉特殊字符 DirectorFinancialPlanningAnalysis
我的预期输出应该是:DirectorFinancialPlanningAnalysis
我的蜘蛛代码是:
hxs = Selector(response)
item = response.request.meta['item']
item ['JobDetailUrl'] = response.url
item ['InternalJobId'] = item ['JobDetailUrl'].re('.*\/(.*?)\.html').groups()
我的输出错误:
item ['InternalJobId'] = item['JobDetailUrl'].re('.*\/(.*?)\.html')
.groups()
exceptions.AttributeError: 'str' object has no attribute 're'
【问题讨论】:
标签: python python-2.7 selenium selenium-webdriver scrapy