【发布时间】:2013-01-21 17:07:10
【问题描述】:
我在尝试输出我正在解析的匹配节点的内容时遇到问题:
<div class="description">some text <br/>more text<br/></div>
我使用HTML::TreeBuilder::XPath 来查找节点(这个类只有一个div):
my $description = $tree->findnodes('//div[@class="description"]')->[0];
它找到了节点(我相信返回为HTML::Element)但$description->as_HTML 也包含元素本身 - 我只希望元素中包含的所有内容都是 HTML:
some text <br/>more text<br/>
我显然可以用正则表达式去掉它,但这感觉很乱,我确定我只是在某处缺少一个函数来做它?
【问题讨论】:
标签: perl xpath html-parsing html-tree