【发布时间】:2015-08-09 10:15:19
【问题描述】:
谁能解释一下为什么 U+2126 (Ω) 和 U+03A9 (Ω) 的 NFD 归一化会产生相同的表示并且不保留代码点?我预计这种行为仅适用于 NFKD 和 NFKC(以及带有变音符号的字符)。
result1 = unicodedata.normalize("NFD", u"\u2126")
result2 = unicodedata.normalize("NFD", u"\u03A9")
print("NFD: " + repr(result1))
print("NFD: " + repr(result2))
输出:
NFD: u'\u03a9'
NFD: u'\u03a9'
【问题讨论】:
标签: unicode character-encoding