【发布时间】:2016-11-26 05:08:25
【问题描述】:
我有这个 XML 文件:
<page>
<title>test</title>
<text>bla bla</text>
</page>
<page>
<title>another test</title>
<text>bla bla</text>
</page>
<page>
<title>hello</title>
<text>hello world</text>
</page>
我想解析文件(PHP SAX解析器)找到标题为“hello”的页面,然后保存对应的Text标签内容..我目前做的是这样的:
$pages = array();
$elements = null;
function startElements($parser, $name, $attrs) {
global $wiki, $elements;
if(!empty($name)) {
$elements = $name;
}
}
function endElements($parser, $name) {
global $elements;
if(!empty($name)) {
$elements = null;
}
}
function characterData($parser, $data) {
global $pages, $elements;
if(!empty($data)) {
if ($elements == 'TITLE' ) {
if((preg_match('/Hello/', $data)==1))
{
// ... I found the page with the good title, but how to get the following text tag content!!
}
}
}
}
$parser = xml_parser_create();
xml_set_element_handler($parser, "startElements", "endElements");
xml_set_character_data_handler($parser, "characterData");
if (!($handle = fopen('tmp.xml', "r"))) {
die("could not open XML input");
}
while($data = fread($handle, 4096)) {
xml_parse($parser, $data);
}
关于如何使用特定的 Titles 标签获取 Text 标签的内容有什么想法吗?我可以通过将所有数据保存在一个数组中来获得我需要的结果..然后搜索!但我想要一个更好的解决方案。
谢谢。
【问题讨论】:
-
@splash58 是的,一个巨大的 XML。
-
巨大有多大? 100 MB 或 10 GB
-
@vtd-xml-author 15 GB :D
标签: php xml xml-parsing sax saxparser