【发布时间】:2019-01-18 14:06:01
【问题描述】:
我第一次有网络抓取脚本(Perl 语言)它运行良好,但在〜 3500(GET 请求)服务器返回 403 错误(禁止|不是 ip 禁止)但在(python 语言)中使用相同的脚本时我发现同样的问题工作,但在〜3500个请求后我得到403(24小时后重新运行)我不知道问题是什么以及如何解决它
我阅读了有关 libwww-perl 的信息:
https://cloudkul.com/blog/block-libwww-perl-attack-in-apache-web-server/
【问题讨论】:
-
你怎么知道这不仅仅是禁止你的 IP 地址?
-
您是否尝试过联系网站运营商?你有他们的权限来抓取他们的网站吗?
-
@melpomene 我可以从 burp 套件发送请求
-
如果我理解正确,您问为什么在发送 3500 个请求而被阻止后收到不同的错误消息?为什么你认为这很重要?
标签: python perl web-scraping block http-status-code-403