【发布时间】:2019-03-10 14:41:26
【问题描述】:
我正在尝试抓取屏幕截图中的每个面板,但我没有获得正确的 xpath 来抓取这些部分。任何人都可以帮助我。
【问题讨论】:
标签: python-3.x web-scraping scrapy
我正在尝试抓取屏幕截图中的每个面板,但我没有获得正确的 xpath 来抓取这些部分。任何人都可以帮助我。
【问题讨论】:
标签: python-3.x web-scraping scrapy
此数据来自对https://www.seloger.com/detail,json,caracteristique_bien.json?idannonce=142632059 的附加请求。在那里您将获得包含全部信息的 json。
更新:
url_id = re.search(r'/(\d+)\.htm', response.url).group(1)
details_url = 'https://www.seloger.com/detail,json,caracteristique_bien.json?idannonce={}'
# make request to url
yield Request(details_url.format(url_id))
【讨论】: