【发布时间】:2014-11-22 15:15:07
【问题描述】:
Unicode 字符串在 Python 的内存中是如何按字面意思表示的?
例如,我可以将'abc' 可视化为它在内存中的等效 ASCII 字节。整数可以被认为是 2 的恭维表示。然而u'\u2049',即使在UTF-8 中表示为'\xe2\x81\x89' - 3 个字节长,我如何可视化内存中的文字u'\u2049' 代码点?
是否有特定的方式存储在内存中? Python 2 和 Python 3 对待它的方式不同吗?
对于任何好奇的人来说,很少有相关的问题:
1) How are these strings represented internally in Python interpreter ? I don't understand
【问题讨论】:
标签: python string unicode python-internals