【问题标题】:How can I detect the codepage of a serial of text,2 byte for a character,It's polish如何检测一系列文本的代码页,一个字符的 2 个字节,它的波兰语
【发布时间】:2017-12-07 06:05:30
【问题描述】:

如何检测一系列文本的代码页,一个字符2字节,它是波兰语。对于普通英文字符,只需在ansi代码中添加0x00,对于特殊波兰字符,这两个字节具有特殊含义.没有文件头,只有这样的字节流。

这里的示例

字符串:波兰语

字节:50 00/6f 00/42 01/05 01/63 00/7a 00/65 00/69 00/61 00

我认为它不是 unicode,因为 unicode 中的 0x4201 是中文字符 不是波兰语。

那么任何人都可以帮助我吗?非常感谢!

【问题讨论】:

    标签: unicode codepages polish


    【解决方案1】:

    它的 UTF-16 Big Endian。

    $ echo -n "Połączenia" | iconv -f UTF8 -t UTF16BE | hexdump
    0000000 5000 6f00 4201 0501 6300 7a00 6500 6e00
    0000010 6900 6100
    

    【讨论】:

    • 多谢大佬,我刚刚找到了自己,但一路走来,谢谢你。我应该早点过来问问,我花了半天时间才找到。
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2017-11-29
    • 1970-01-01
    • 2010-11-08
    • 2013-10-10
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多