【发布时间】:2014-12-27 21:16:00
【问题描述】:
假设我从 Python 中的套接字读取了一些内容 并且必须即时将其解码为 UTF-8。
我无法将所有内容都保存在内存中, 所以我必须在收到并保存到文件时对其进行解码。
可能会发生,我只会收到部分字符字节, (€-符号由三个字节表示,例如在 Python 中为 '\xe2\x82\xac')。
假设我只收到前两个字节 (\xe2\x82),如果我尝试解码 它,正如预期的那样,我得到了“UnicodeDecodeError”。
我总是可以尝试解码当前内容并检查它是否抛出异常
- 但是这种方法的可靠性如何?
- 我如何知道或确定我是否可以解码当前内容?
- 如何正确操作?
谢谢
【问题讨论】:
标签: python sockets unicode utf-8