【发布时间】:2016-03-04 15:29:32
【问题描述】:
我在 python 中玩unicode。
所以有一个简单的脚本:
# -*- coding: cp1251 -*-
print 'юникод'.decode('cp1251')
print unicode('юникод', 'cp1251')
print unicode('юникод', 'utf-8')
在 cmd 中,我已将编码切换为 Active code page: 1251。
还有输出:
СЋРЅРёРєРѕРґ
СЋРЅРёРєРѕРґ
юникод
我有点困惑。
由于我已将编码指定为cp1251,因此我希望它会被正确解码。
但结果有一些垃圾代码点被解释。
我知道'юникод' 只是一个字节,例如:
'\xd1\x8e\xd0\xbd\xd0\xb8\xd0\xba\xd0\xbe\xd0\xb4'.
但是有一种方法可以使用cp1251 在终端中获得正确的输出?
我应该手动构建字节字符串吗?
我好像误会了什么。
【问题讨论】:
-
你能突出显示你想要它的样子吗?
-
我希望我的终端中的
print unicode('юникод', 'cp1251')是юникод而不是垃圾符号。
标签: python python-2.7 unicode encoding