【问题标题】:Encoding utf-8 and decode to iso-8859-16编码 utf-8 并解码为 iso-8859-16
【发布时间】:2016-11-16 16:27:57
【问题描述】:

我试图了解从 utf-8 到其他编码的转换是如何工作的。

在这个例子中:- 我有一个用“utf-8”编码并用“iso-8859-16”解码的字符串。 只是想了解一下,在转换过程中如何添加额外的字节?

>>> r_post='Hello Günter'
>>> r_post=r_post.encode('utf-8')
>>> r_post
b'Hello G\xc3\xbcnter'
>>> r_post=r_post.decode('iso-8859-16')
>>> r_post
'Hello GĂŒnter'

【问题讨论】:

    标签: python encoding utf-8


    【解决方案1】:
    Hello G\xc3\xbcnter
    

    这是一个字节字符串,用于“ü”的两个字节方便地突出显示。在 UTF-8 编码中,字符 'ü' 由两个字节 C3 BC 表示。

    读取这些字节并以 ISO-8859-16 编码解释它们会得到字符“Hello GĂŒnter”。在 8859-16 中,字节 C3 代表字符“Ă”,BC 代表字符“Œ”。

    如果您需要更深入的解释,请参阅What Every Programmer Absolutely, Positively Needs To Know About Encodings And Character Sets To Work With Text

    【讨论】:

    • 感谢您的解释。非常有帮助。
    猜你喜欢
    • 1970-01-01
    • 2016-10-04
    • 1970-01-01
    • 2010-12-27
    • 1970-01-01
    • 2011-09-23
    • 1970-01-01
    • 2012-05-27
    • 1970-01-01
    相关资源
    最近更新 更多