【发布时间】:2013-04-11 17:17:04
【问题描述】:
我想使用 python 下载一个 zip 文件。
使用这种类型的网址, http://server.com/file.zip 通过使用 urllib2.urlopen 并将其写入本地文件,这非常简单。
但就我而言,我有这种类型的网址: http://server.com/customer/somedata/download?id=121&m=zip, 表单验证后启动下载。
准确地说,在我的情况下,我想将它部署在 heroku 上,所以我不能使用用 C++ 构建的 spynner。此下载是在使用 scrapy 进行抓取后启动的。
从浏览器下载运行良好,我得到了一个带有其名称的好 zip 文件。使用 python 我只得到 html 和 header 数据...
有没有办法从python中的这种类型的url中获取文件?
【问题讨论】:
-
响应是什么样的?它是一个 HTML 页面还是你所追求的实际文件,就像一个 Scrapy
Response对象? -
这不是重复的,在这里我无法像在 pdf 文件中那样获取 .body。
-
我得到一个 html 页面,是的
-
提供一个真实的链接,以便我检查它的源代码。