【发布时间】:2019-09-20 16:42:33
【问题描述】:
我正在尝试从以下短语中提取国家(此处为印度尼西亚):
<small class="text-muted">
<span class="hidden-xs">Football / </span>Indonesia /
<span class="hidden-xs xh-highlight">Kick off: </span>11 Sep 2019, 11:30 </small>
目前,我只是使用以下命令来提取文本:
.xpath('.//small[@class="text-muted"]/text()').extract()
仅提取印度尼西亚的正确正则表达式命令是什么?
【问题讨论】:
-
这似乎是一个XPath问题,与正则表达式无关。
标签: regex xpath scrapy web-crawler