【发布时间】:2018-09-20 05:12:50
【问题描述】:
关于 utf-8 > unicode 转换有很多问题,但我的问题仍然没有找到答案。
让我们有这样的字符串:
a = "Je-li pro za\\xc5\\x99azov\\xc3\\xa1n\\xc3\\xad"
Python 3.6 像 Je-li pro za\xc5\x99azov\xc3\xa1n\xc3\xad 一样理解这个字符串。我需要将此类似 utf-8 的字符串转换为 unicode 表示。最终结果应该是Je-li pro zařazování。
a.decode("utf-8") 我得到 AttributeError: 'str' object has no attribute 'decode',因为 Python 意味着该对象已经解码。
如果我先用bytes(a, "utf-8") 将其转换为字节,则反斜杠只会加倍,.decode("utf-8") 再次将其返回到我当前的a。
如何从 a 获取 unicode 字符串 Je-li pro zařazování?
【问题讨论】:
-
this 没有帮助吗? (在你说“不,不是”之前,它不使用
bytes(a,"utf-8"),你需要更好的解释。) -
还有...为什么你有两个
\s? -
为什么有两个反斜杠...这是一个奇怪的 API 的结果,它返回一些解码的字符,而另一些则没有。
标签: python-3.x unicode utf-8 python-unicode