【发布时间】:2013-10-19 09:37:30
【问题描述】:
我尝试将 Html 页面转换为 ecs 对象。为此,我使用部分 XPath。 (我正在用 Java 编码) 唯一的问题是,我希望 XPath 将所有节点名称和文本作为字符串返回。这有点难以解释,这里举个例子:
HTML 文档:
<html>
<head>
<title>Derp</title>
</head>
<body>
<div>nonsense<IOText></div>
<a href="http://google.de/">It's Google!</a>
</body>
现在我要执行以下 XPath:
/html
并希望结果如下所示:
<head>
<title>Derp</title>
</head>
<body>
<div>nonsense<IOText></div>
<a href="http://google.de/">It's Google!</a>
</body>
有这样的功能吗?
【问题讨论】:
-
好吧,直到现在我只是在寻找一个解决方案......但我找不到一个或想到一个:/ 我尝试了一些函数,如 text()(返回 null,什么是合理的)和一些其他 XPath 函数,它们只是抛出错误,因为 Java 不知道它们(name() 或 local-name())
-
所以你只想删除
<html>? -
不,我想要标签内的文本,我使用 XPath 请求。另一个例子:如果我执行 /html/head 它应该返回
Derp