【发布时间】:2017-11-07 17:01:00
【问题描述】:
我正在尝试抓取这个page,当我执行scrapy shell "https://redsea.com/en/apple-iphone-x-64gb-silver.html" 时,它会下载html 页面,我可以在浏览器中使用view(response) 查看下载的html:
但是当我尝试通过response.css('.page-title') 获取任何数据产品名称时,它给了我空的响应:
使用scrapy抓取使用rest-api获取数据的网站只是下载没有数据的网站结构html,scrapy无法获取该数据是有道理的。但在这种情况下,scrapy 会下载带有数据的 html 文件,但无法使用 css 或 xpaths 读取它。我不明白这种行为。
【问题讨论】:
-
我们没有得到页面源中的值,意味着数据是动态加载的。所以你必须使用像splash、selenium这样的包来获取动态加载的数据。
标签: scrapy scrapy-shell