【问题标题】:Wget gives Error 403: forbiddenWget 给出错误 403:禁止
【发布时间】:2017-11-06 03:08:53
【问题描述】:

http://filedownloads.co.in/downloads/domain/October
在上面给出的 web 目录中,大约有 30 个 zip 文件,如

http://filedownloads.co.in/downloads/domain/October/2017-10-09hhwerahhqw_country-specific-database.zip

http://filedownloads.co.in/downloads/domain/October/2017-10-20weroiunewd_country-specific-database.zip

我想下载该目录的所有文件。我已经尝试了堆栈溢出上与我的问题相关的所有可用选项,但每次我得到相同的错误 403:禁止。
我尝试了以下命令:
wget --user-agent="Mozilla" -r -np -A.zip http://filedownloads.co.in/downloads/domain/October

wget -r -l1 -H -t1 -nd -N -np -A.zip -erobots=off http://filedownloads.co.in/downloads/domain/October/

wget -U firefox -r -np http://filedownloads.co.in/downloads/domain/October/

【问题讨论】:

    标签: .htaccess httprequest wget http-status-code-403 httpforbiddenhandler


    【解决方案1】:

    我尝试使用浏览器访问您的链接并收到相同的“禁止”消息。

    尝试在私人窗口中打开链接,看看会发生什么。 您很可能已登录此站点,因此您的浏览器具有允许您查看此目录的 cookie。 如果是这样,您将需要找出这些 cookie 并在 wget 中指定它们,以便它可以访问受保护的资源。

    【讨论】:

    • 我也无法访问顶部链接,但可以访问子链接。没有与该域关联的任何 cookie。此目录中大约有 30 个文件,所有文件都可以通过其完整链接访问。
    • 嗯...如果页面上没有可访问的文件列表,则 wget 或 curl 或任何其他工具都无法确定文件名并下载文件。
    • 如果您有一个要下载的文件列表,那么您可以将其存储在一个文本文件中,然后让 wget 从该列表中下载所有文件。如果您只知道一些文件名并想下载另一个文件名 - 那么糟糕,这是不可能的。为此,您要么需要猜测文件命名算法,要么进行暴力猜测名称,这非常复杂。
    • 你能帮我确定文件名吗?文件名 (2017-10-13hsjewewer_country-specific-database.zip) 基于此模式。日期8 到 10 个字符的字母字符串_country-specific-database.zip
    • 看起来这些字母前缀是随机生成的。恐怕我帮不上忙。
    猜你喜欢
    • 2021-11-22
    • 2013-08-29
    • 1970-01-01
    • 2021-09-04
    • 1970-01-01
    • 1970-01-01
    • 2011-04-01
    • 1970-01-01
    • 2021-08-26
    相关资源
    最近更新 更多