【发布时间】:2009-07-29 21:58:43
【问题描述】:
我正在尝试解析格式良好的 xhtml 文档。
我在节点迭代期间遇到问题。
我的 xHtml 的结构类似于
<?xml version="1.0" encoding="UTF-8"?>
<html>
<head>...</head>
<body>
...
<form>
...
<div class="AB"> (1 or 2 times)
...
<div class="CD">
...
<table>
<tbody>
<tr> (1 to N times)
<td> XXX </td>
<td> YYY </td> ...
我需要的信息包含在列 (td) 中。
我想构造 N 个对象。因此,每一行 (tr) 在其列中都包含构造对象所需的信息。
我有 class="AB" 的 1 或 2 个 div。所以基本上我会有 1 或 2 个对象 AB,其中包含从表中的每一行创建的其他对象的列表
所以首先我提取了这些 AB div 的 NodeList
NodeList ABlist= (NodeList) xpath.evaluate("//div[@class='AB']", document, XPathConstants.NODESET)
现在我正在尝试获取第一个 div AB 的所有 tr elem 的 NodeList。
NodeList trList = (NodeList) xpath.evaluate("/div/table//tr", ABlist.item(0), XPathConstants.NODESET);
在这种情况下,trList 是空的。你知道我的代码有什么问题吗?
谢谢
【问题讨论】: