【发布时间】:2020-01-05 14:09:33
【问题描述】:
在研究 Unicode 和 utf-8 编码时,
我注意到 utf-8 编码的第 129 个 Unicode 以 0xc2 开头。
我检查了 0xcf 的最后一个字母。
没有 Unicode 被 0xc1 编码为 0xc1。
为什么第 129 个 unicode 从 0xc2 而不是 0xc1 开始?
【问题讨论】:
-
你的问题不清楚。 Unicode 代码点 128 和 129 是
C0和 `C1` 字符集中的有效字符;没有遗漏。我也不确定 UTF-8 与您的问题有什么关系。 -
虽然链接的副本解决了 0xC0 的使用问题,而您询问的是 0xC1,但两者的解释是相同的。有关详细信息,请参阅en.wikipedia.org/wiki/UTF-8#Codepage_layout。
-
链接的重复是一个不同的问题,具有相似的答案,所以我认为这不应该作为重复的问题关闭。