【问题标题】:Convert HTML-escaped strings to plain Unicode/ASCII [duplicate]将 HTML 转义字符串转换为纯 Unicode/ASCII [重复]
【发布时间】:2012-11-27 04:59:43
【问题描述】:

可能重复:
Java: How to decode HTML character entities in Java like HttpUtility.HtmlDecode?

是否有 Java/Android 方法可以将 HTML 转义字符串(例如 Öß)转换回它们的 ASCII/Unicode 表示形式(例如 Öß)?

我当然不想做一个简单的字符串替换,只尝试每个存在的 HTML 转义序列,我猜有一个现成的解决方案?

谢谢!

【问题讨论】:

  • StringEscapeUtils.unescapeHtml(myHtmlString)

标签: java android html


【解决方案1】:

使用这个:

import org.apache.commons.lang.StringEscapeUtils;

public class StringEscapeUtilsTrial {
public static void main(String[] args) {
    String strHTMLInput = "<p>MyName<p>";
    String strEscapeHTML = StringEscapeUtils.escapeHtml(strHTMLInput);
    String strUnEscapeHTML = StringEscapeUtils.unescapeHtml(strEscapeHTML);
    System.out.println("Escaped HTML >>> " + strEscapeHTML);
    System.out.println("UnEscaped HTML >>> " + strUnEscapeHTML);
    }
}

【讨论】:

    猜你喜欢
    • 2012-07-19
    • 2010-12-09
    • 2013-07-19
    • 2018-03-21
    • 2011-01-02
    • 2016-02-25
    相关资源
    最近更新 更多