【问题标题】:What this the first three characters inside xmlxml 中的前三个字符是什么
【发布时间】:2020-12-27 16:16:39
【问题描述】:

为什么我通过用 java 读取文件内容作为字节数组得到以下输出?

File f = new File( "exampleData.xml" );
byte[] data = getBytesFromFile("data.xml");
for (byte zeichen : data) {
    char zzeichenCharacter = (char)zeichen;
    System.out.println(zzeichenCharacter + "  : " + String.valueOf(zeichen));
}

输出:

￯  : -17
ᄏ  : -69
﾿  : -65
<  : 60
?  : 63

当我将文件 exampleData.xml 中的内容复制到名为 exampleDataCopy.xml 的第二个文件并使用上面相同的代码时,我得到了不同的输出:

<  : 60
?  : 63
x  : 120
m  : 109
l  : 108

【问题讨论】:

  • 文件有什么编码?
  • 顺便说一句,String.valueOf(0xff &amp; zeichen) 会给出无符号字节,这可能是一种更“自然”的打印字节的方式。

标签: java arrays controls byte special-characters


【解决方案1】:

前三个字节是Byte order mark的UTF-8编码。

十六进制表示为EF BB BF

您应该以 UTF-8 格式读取文件,而不是逐字节处理。

【讨论】:

    猜你喜欢
    • 2010-10-18
    • 2022-01-26
    • 2019-09-07
    • 1970-01-01
    • 2016-04-21
    • 2019-10-24
    • 2011-01-28
    • 2015-01-03
    相关资源
    最近更新 更多