【发布时间】:2014-06-02 22:15:55
【问题描述】:
有一个基于 PHP 的网站,我想从中复制数据。
问题在于该网站的数据只能通过公司名称搜索页面访问 - www.example.com/companynamesearch.php
结果显示在同一个 URL 下,因此它没有单独的公司名称 URL 来抓取数据。
谁能建议一种从网站中提取数据的简单方法?
谢谢
【问题讨论】:
-
每个页面都有一个单独的 URL。它可能只是作为 ajax 调用埋在 javascript 中。如果您给我们真实的网站,我们也许可以提供具体的帮助。此外,如果您确实需要从 HTML 页面中提取数据,请考虑使用 YQL:developer.yahoo.com/yql
-
你说得对,布拉德。这就是为什么我说可能。
-
"从"复制数据" = 窃取?
-
如果你只有一个搜索引擎,你就必须向它扔几个 bajillion 搜索词并抓取结果。像这样的抓取网站往往会受到网站所有者的反对......换句话说,您最好联系运营商并协商提要。否则你只是在偷东西。
-
“复制本网站中的任何内容都需要书面许可。”能做的人,不能逃避别人网站的人:(
标签: php database extract replicate