将HTML转义字符串转换为纯Unicode/ASCII

Elm*_*lmi 5 html java android

可能重复:
Java:如何解码Java中的HTML字符实体,如HttpUtility.HtmlDecode?

是否有Java/Android方式将HTML转义字符串(如Ö或ß)转换回其ASCII/Unicode表示(例如Ö或ß)?

我当然不想做一个简单的字符串替换,并尝试只存在的每个HTML转义序列,我猜有一个现成的解决方案?

谢谢!

Har*_*Raj 10

用这个:

import org.apache.commons.lang.StringEscapeUtils;

public class StringEscapeUtilsTrial {
public static void main(String[] args) {
    String strHTMLInput = "<p>MyName<p>";
    String strEscapeHTML = StringEscapeUtils.escapeHtml(strHTMLInput);
    String strUnEscapeHTML = StringEscapeUtils.unescapeHtml(strEscapeHTML);
    System.out.println("Escaped HTML >>> " + strEscapeHTML);
    System.out.println("UnEscaped HTML >>> " + strUnEscapeHTML);
    }
}
Run Code Online (Sandbox Code Playgroud)