【发布时间】:2011-04-10 05:27:37
【问题描述】:
所以我创建了一个网络爬虫,一切正常,只有一个问题。
通过file_get_contents($page_data["url"]);,我得到了网页的内容。当我的某个关键字出现在网页上时,会扫描此网页。
$find = $keywords; $str = file_get_contents($page_data["url"]);
if(strpos($str, $find) == true)
当我想将数据插入 mysql-database 时,我只想要关键字所在的 div 中的信息。
我知道我必须使用 DOM,但我是 domdocument 场景的新手。
【问题讨论】:
-
您可以随时编辑SO上的问题,无需另开新题。没什么大不了的,但为了未来。
-
是的,我在发帖后注意到了,soz。编辑:删除最旧的线程
标签: php html web-crawler domdocument