【发布时间】:2011-11-20 22:14:29
【问题描述】:
我阅读了this blogentry 关于 perl 以及它们如何处理 unicode 和 unicode 规范化的内容。 据我了解,简短版本是有几种方法可以用 unicode 编写标识符“é”。作为一个 unicode 字符或作为两个字符的组合。而且perl程序可能无法区分它们导致奇怪的错误。
这让我想到,Eclipse 中的 Java 编辑器如何处理 unicode?或者一般的java,因为我猜那是同一个问题。
一方面specification 说:
两个标识符只有相同时才相同,即每个字母或数字具有相同的 Unicode 字符。
但另一方面,unicode 字符被翻译:
此转换步骤允许任何程序仅使用 ASCII 字符表示。
这似乎相互矛盾?
【问题讨论】: