【发布时间】:2020-10-28 00:08:13
【问题描述】:
我需要在 h3 class AIRFRAME /h3 但在 h3 class ENGINES /h3 之前提取所有内容:
我需要提取的内容:
“投入使用:2010 年 12 月 自新开始以来的总时间:3,580 小时”等。
HTML code photo - not sure how to embed it directly instead of having a link
以下是我尝试过的,但它没有返回任何内容。我是 Scrapy 和一般编程的新手,所以我希望能得到一些帮助。我试过搜索其他帖子和谷歌一般没有任何运气。
input = response.xpath("//div[@class='large-6 cell selectorgadget_rejected']/h3/text()").extract()
输出 = []
【问题讨论】:
-
从不将代码包含为图像。始终将其作为文本复制到
code部分中,否则无法复制尝试,并且对 SO 毫无价值。 -
提示:检查@class 属性的值是否包含换行符。
-
谢谢。这是我的第一篇文章,所以我会牢记这一点。
标签: html python-3.x xpath web-scraping scrapy