【发布时间】:2017-12-28 13:00:21
【问题描述】:
我认为只是另一个关于 python 编码的问题。我有这个程序:
regex = re.compile(ur'\b[sw]\w+', flags= re.U | re.I)
ergebnisliste = []
for line in fileobject:
print str(line)
erg = regex.findall(line)
ergebnisliste = ergebnisliste + erg
ergebnislistesortiert = sorted(ergebnisliste, key=lambda x: len(x))
print ergebnislistesortiert
fileobject.close()
我正在文本文件中搜索以 s 或 w 开头的单词。我的“ergebnislistesortiert”是排序结果列表。 我将打印结果列表,发现编码有问题:
['so', 'Wer', 'sp\xc3']
'sp\xc3' 应打印为 spät。这里有什么问题?为什么列表元素是utf-8?
我怎样才能得到正确的解码来打印“spät”?
非常感谢大家!
【问题讨论】:
标签: python-2.7 utf-8 string-decoding