【发布时间】:2020-05-02 07:44:28
【问题描述】:
我正在尝试抓取 nordstrom 产品说明。我得到了所有的项目链接(存储在本地 mongodb 数据库中),现在正在遍历它们,这是一个示例链接 https://www.nordstrom.ca/s/leith-ruched-body-con-tank-dress/5420732?origin=category-personalizedsort&breadcrumb=Home%2FWomen%2FClothing%2FDresses&color=001
我的蜘蛛代码是:
def parse(self, response):
items = NordstromItem()
description = response.css("div._26GPU").css("div::text").extract()
items['description'] = description
yield items
我也试过scrapy shell,返回的页面是空白的。 我也在使用scrapy随机代理。
【问题讨论】:
-
“我也试过scrapy shell,返回的页面是空白的”。听起来您被检测为机器人并给出了错误的响应。这就是您需要首先解决的问题。
标签: scrapy