【发布时间】:2012-10-05 21:39:53
【问题描述】:
我有一个名为fields 的ArrayList<String>。我正在尝试使用replaceAll 函数解析每个String 中的HTML,但我觉得我搞砸了正则表达式字符串(我得到了第二个正则表达式here 来表示一个通用的html 表达式) .谁能在这里给我一些关于如何纠正自己的提示?
for(int j = 0; j<fields.size(); j++)
{
String k = fields.get(j);
k.replaceAll("<br>", "\n");
k.replaceAll("<(\"[^\"]*\"|'[^']*'|[^'\">])*>", "");
k.replaceAll("<", "<");
k.replaceAll(">", ">");
fields.set(j, k);
}
【问题讨论】:
-
使用jsoup 之类的东西会容易得多。那你只需要
Jsoup.parse(str).text();