【发布时间】:2017-03-19 23:35:50
【问题描述】:
我正在尝试将一些包含土耳其语字符的单词转换为小写。
从 utf-8 编码的文件中读取单词:
with open(filepath,'r', encoding='utf8') as f:
text=f.read().lower()
当我尝试转换为小写时,土耳其语字符 İ 被损坏。但是,当我尝试转换为大写时,它工作正常。
这里是示例代码:
str = 'İşbirliği'
print(str)
print(str.lower())
这是损坏后的样子:
这是怎么回事?
一些可能有用的信息:
- 我使用的是 Windows 10 cmd 提示符
- Python 3.6.0 版
- chcp 设置为 65001
【问题讨论】:
-
发布实际文字而非图片链接,否则难以复制粘贴自己尝试。
-
@MarkTolonen 在这种情况下,图像是证明问题的唯一合理方式。
-
@zero 啊,好的。最好也从控制台粘贴文本,即使当我们在浏览器中看到它时它可能会发生一点变化。
-
@Zero 可能还需要一张图片,但对于没有土耳其语键盘的人来说,实际的原始文本仍然很有帮助。
标签: python utf-8 character-encoding case-sensitive turkish