【问题标题】:How to print the request header that Scrapy sends?如何打印 Scrapy 发送的请求标头?
【发布时间】:2021-05-30 18:25:07
【问题描述】:

我要做的任务是打印scrapy发送的请求头。我在如何使用scrapy中间件上有些磕磕绊绊。

我在项目settings.py文件中激活了下载器中间件。

DOWNLOADER_MIDDLEWARES = {
    'CarDataPull.middlewares.CardatapullDownloaderMiddleware': 543,
}

然后,我在middlewares.py 文件中的函数process_request 中添加了以下几行。

 print('I was here')
 with open('request_header.txt', 'wb') as a:
     a.write(request)

我看不到任何激活此功能的迹象。

谁能告诉我如何激活该特定功能?或者还有其他打印请求头的方法吗?

【问题讨论】:

    标签: python web-scraping scrapy


    【解决方案1】:

    在启动时,scrapy 返回多个日志条目,包括活动中间件列表。
    如果您希望启用中间件,则此日志行 [scrapy.middleware] INFO: Enabled downloader middlewares: 之后的行应该具有中间件的名称。
    如果没有 - 这意味着您的中间件未激活(最常见的情况 - 中间件路径问题)。

    【讨论】:

    • 嗨乔治!谢谢您的回答。请您详细说明中间件路径的问题吗?你能重现我描述的内容吗?
    猜你喜欢
    • 2019-01-30
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2021-02-03
    • 2021-07-10
    • 1970-01-01
    • 2017-07-03
    • 2016-10-25
    相关资源
    最近更新 更多