【发布时间】:2012-01-28 13:53:49
【问题描述】:
我将大量文本从另一个系统复制到我的 PC。当我在我的电脑上查看文本时,它看起来很奇怪。所以我从另一台电脑上复制了所有字体并将它们也安装在我的电脑上。现在文本看起来不错,但实际上似乎不是 Unicode。例如,如果我复制文本并粘贴到另一个支持 UTF-8 的编辑器(如 Notepad++)中,我只会得到如下所示的英文字符(“bgah;”)。
如何将整个文本转换为 unicode 文本,如下所示。所以我可以复制文本并粘贴到其他任何地方。
பெயர்
以上文字是使用http://www.google.com/transliterate/indic/Tamil手动获取的
我需要完成这个转换,所以我可以将它们复制到数据库表中。
【问题讨论】:
-
如果您可以创建每个字符代码及其对应的 Unicode 点的表格,那么有人可以帮助您创建执行翻译的程序。在那之前,这对 SO 来说是题外话。
-
看起来问题是文本采用非标准字符编码的问题,与 UTF-8 无关。添加标签“字符编码”,删除标签“utf-8”。
标签: unicode character-encoding fonts tamil