【发布时间】:2012-01-03 09:51:09
【问题描述】:
我需要提取两个 HTML 标记之间的文本并将其存储在一个字符串中。我要解析的 HTML 示例如下:
<div id=\"swiki.2.1\"> THE TEXT I NEED </div>
我在Java 中使用(swiki\.2\.1\\\")(.*)(\/div) 模式完成了这项工作,并从组$2 中获取了我想要的字符串。但是,这在android中不起作用。当我去打印 $2 的内容时,什么都没有出现,因为匹配失败。
有没有人在 android 中使用正则表达式时遇到过类似的问题,或者是否有更好的方法(非正则表达式)首先解析 HTML 页面。同样,这在标准的 java 测试程序中运行良好。任何帮助将不胜感激!
【问题讨论】:
-
jsoup.org 应该有 android 版本...关于您的错误/匹配失败...也许在设备上您正在加载本网站的移动版本...
-
这是一个很好的观点。但是,我刚刚检查了 HTML,而我在网站的移动版本中寻找的是相同的。我现在看看那个链接,稍后再回复。谢谢
标签: java android html regex parsing