【发布时间】:2011-10-27 13:34:44
【问题描述】:
我在使用 XPath 获取 <script>...<script/> 之后的所有 HTML 标记时遇到了一些问题。
我的 HTML:
<table dir="rtl"...>
<tbody>
<tr>..</tr>
<script src = get.aspx?type=js&file=ajax&rev=3 ....>
<script language="JavaScript".....>
<script>...<script>
<tr>..</tr>
<tr>..</tr>
<tr>..</tr>
<tr>..</tr>
<tr>..</tr>
我想获取 XPath 中 script 标签之后的所有标签。
这是网页链接:source
【问题讨论】:
-
如果您想获取文档的其余部分,您可能不应该为此使用 XPath。 SAX 解析可能会更有效。当你实现一个开始解析元素的回调函数时,检查它是否是
script并将BOOL hitJavascript设置为YES,然后当你解析tr时检查if(hitJavascript),然后做你想做的事当您在tr内部时,想要内部的td。
标签: xpath