【发布时间】:2012-10-08 16:22:40
【问题描述】:
问题:
试图从我可以通过 PHP 获得的 HTML 代码中提取特定文本。
HTML 代码:
<a href="/debatt/s-vill-ha-tioarig-skolplikt-och-farre-elever-i-klassen">
<span class="number">2. </span>Skolplikt och färre elever i klassen
<br />
<span class="metadata">I går</span>
</a>
<a href="/sthlm/edholm-backar-om-skolornas-smorforbud">
<span class="number">3. </span>Edholm backar om skolornas smörförbud
<br />
<span class="metadata">16 okt</span>
</a>
期望的输出:
2. Skolplikt och färre elever i klassen
3. Edholm backar om skolornas smörförbud
两个代码示例具有相同的 HTML 结构。是否可以通过 Simple HTML DOM 做到这一点,还是应该追求正则表达式?
【问题讨论】:
-
Simple HTML DOm可以做到这一点,你可以在网上找到现成的类(simplehtmldom)来解析HTML并从DOM中获取想要的文本