【发布时间】:2016-09-22 15:00:00
【问题描述】:
我使用 python 2.7.10。
在处理字符编码时,在阅读了大量关于该主题的堆栈溢出等内容后,我遇到了这种对我来说看起来很奇怪的行为。 Python解释器输入
>>>u'\u00b0'
产生以下输出:
u'\xb0'
我可以使用 dos 窗口、空闲控制台和wing-ide python shell 重复此行为。
我的假设(如果我错了,请纠正我): “度数符号”有 unicode 0x00b0、utf-8 代码 0xc2b0、latin-1 代码 0xb0。 Python 文档说,带有 u 前缀的字符串文字是使用 unicode 编码的。
问题:为什么将结果转换为带有与 latin-1 编码匹配的字节转义序列的 unicode-string-literal,而不是保留 unicode 转义序列?
提前感谢您的帮助。
【问题讨论】:
标签: python unicode character-encoding python-2.x string-literals