【发布时间】:2018-06-28 16:58:09
【问题描述】:
我有一些 python 代码,其中包含对一些印地语文本的识别。我故意将它保存为UTF-8,但是当我重新打开它时,印地语符号会变为俄语文本(大部分)或只是?。编码也更改为OEM 866,这是西里尔字母。
由于这种编码更改,我的代码也根本没有运行,因为正则表达式将? 视为特殊输入。那我该怎么办?
【问题讨论】:
-
正是出于这样的原因,我建议您将 Python 文件保存为 ASCII 纯文本,并改用 Unicode 代码点来捕获符号。 IE。
\u0905\u092d\u0940== अभी