【发布时间】:2012-09-14 07:14:25
【问题描述】:
我从我无法解析的一个提要提供商处获取以下带有 XML 中的 unicode 字符的字符串。我还尝试获取这些字符的十六进制代码,然后在其前面加上 \u,但这也不起作用。
String str = "????????????????</fullText" + ">";
StringBuilder strb = new StringBuilder();
char[] chars = str.toCharArray();
for (int i = 0; i < chars.length; i++) {
char c = chars[i];
if ( c >= Character.MIN_HIGH_SURROGATE && c <= Character.MAX_HIGH_SURROGATE ) {
char ch2 = chars[i+1];
} else
strb.append(c);
}
System.out.println(strb.toString());
理想情况下,这应该跳过这些字符,但它没有。我想去掉字符串中的那些字符。
有没有人遇到过类似的问题?非常感谢这方面的任何帮助。
外婆
【问题讨论】:
-
“无法解析”是什么意思?错误?例外?您的 XML 源文档是 UTF-8 吗?
-
是的,它是 UTF-8,我能够解析这样的中文和字符,但是我得到这些带有 01F389 文字的框,这些框没有被解析并在我的应用程序上显示框。任何想法..
标签: java string unicode xml-parsing