【发布时间】:2013-08-18 15:45:42
【问题描述】:
我正在尝试找出在 Perl 中使用 HTML::TreeBuilder 从 XML 文件中的某些 HTML 中提取几段文本的最佳方法。
我使用$tree->address(或者我认为)让它工作,直到我意识到并非所有条目的顺序都相同。
如果不检查列表中的每一项,似乎每个条目都有几个<div> 元素,但<div> 中只有一个有<p> 元素。并且<div> 都没有类,这会使这变得容易。
我尝试了几种不同的方法,因此似乎没有任何方法可以提取我想要的文本。我查看了几个不同的示例,但没有一个与我正在寻找的内容非常接近。
如果有这样的工作就好了:
$bodyText = $tree->look_down( '_tag' => 'div' => 'p' );
但这给了我错误:
param list to look_down ends in a key!
无论如何,也许有人可以帮我指出正确的方向,我一直在寻找整夜,现在我的脑痛。
谢谢!
约翰
【问题讨论】:
-
您能添加一个 HTML 的 sn-p 示例吗?