【发布时间】:2014-01-07 23:33:16
【问题描述】:
我有一个从 rss 提要生成的页面,但它是使用附加的 html、head 和 body 标记生成的。我只想得到一个div,它的内容来自该页面并将其加载到我的页面中。我想我需要使用curl 从页面加载,我发现了很多加载整个页面的示例,但是我怎样才能只加载我正在寻找的特定 div?
【问题讨论】:
-
使用 curl 删除内容后,使用正则表达式查找特定的 div 标签。
我有一个从 rss 提要生成的页面,但它是使用附加的 html、head 和 body 标记生成的。我只想得到一个div,它的内容来自该页面并将其加载到我的页面中。我想我需要使用curl 从页面加载,我发现了很多加载整个页面的示例,但是我怎样才能只加载我正在寻找的特定 div?
【问题讨论】:
首先,没有理由使用 curl 进行简单的页面下载,只需使用:
$html = file_get_contents('http://www.stackoverflow.com');
之后你有两个选择:
strpos 和substr 查找您关心的代码的特定部分。纯粹主义者通常讨厌选项 2,因为它在很多方面本质上不如第一个。然而,编码工作也少得多,而且对于糟糕的源代码很可能更可靠。您想使用哪个选项取决于您 - 对于一个简单的一次性案例,如果您知道它们,我肯定会选择简单的方法并使用正则表达式,或者如果您不知道,则使用 strpos。
【讨论】: