【发布时间】:2011-05-31 13:18:57
【问题描述】:
我正在尝试制作网站爬虫。我在我的本地机器上做了它,它在那里工作得很好。当我在我的服务器上执行相同的操作时,它会显示 403 禁止错误。 我正在使用PHP Simple HTML DOM Parser。我在服务器上遇到的错误是这样的:
警告: file_get_contents(http://example.com/viewProperty.html?id=7715888) [function.file-get-contents]:失败 打开流:HTTP 请求失败! HTTP/1.1 403 禁止在 /home/scraping/simple_html_dom.php 上 第 40 行
触发它的代码行是:
$url="http://www.example.com/viewProperty.html?id=".$id;
$html=file_get_html($url);
我已经检查了服务器上的 php.ini,并且 allow_url_fopen 已打开。可能的解决方案是使用 curl,但我需要知道我哪里出错了。
【问题讨论】:
-
服务器是你的吗?如果是这样,您或您的托管服务似乎已配置安全设置以防止被废弃。
-
它不是“我的”服务器,而是专用服务器。
-
我误读了这个问题。我以为你在报废自己的网站(即,你有明确许可的网站)。 @Pekka 说得对。
-
投票结束过于广泛。如果服务器返回 403,则表示请求被禁止。如果不是您的服务器,则无法知道除此之外的任何内容。