【发布时间】:2010-12-27 07:18:59
【问题描述】:
我需要从网页上解析一些数据。如何使用 HTML::Parser 提取标签之间的文本?
考虑以下示例代码:
#!/usr/bin/perl
use strict;
use warnings;
use HTML::Parser;
use Data::Dumper;
my $find_title = HTML::Parser->new(
api_version => 3,
start_h => [
sub {
my ($tag, $attr) = @_;
print Dumper \@_;
},
'tag'
],
);
my $html = join '',
"<html><head><title>Extract me!</title></head><body>",
(map { qq(<a href="http://$_.com">$_</a>) } qw/foo bar baz/),
"</body></html>";
$find_title->report_tags('title');
$find_title->parse($html);
如何解决此问题以便提取标题?这只会提取标签。
【问题讨论】: