【发布时间】:2019-10-15 09:53:00
【问题描述】:
在我的 Python 脚本中,我试图读取一个文本文件,该文件包含带有人们名字和姓氏的列,其中一些包含非 ASCII 字符,例如 ñ。但是当我这样做时,我得到了错误UnicodeDecodeError: 'utf8' codec can't decode byte 0x96 in position 66。
根据我在网上阅读的内容,我知道您可以通过忽略或删除非 ASCII 字符来解决此问题,但我不想这样做。有没有一种直接的方法可以将文件中的所有非 ASCII 字符转换为普通字符串?
目前,我正在使用infile = open(filename, 'rU') 打开我的文件。
不重复问题:我问的是如何读取包含 unicode 字符的文件,而不是如何将 unicode 字符串写入文件。
【问题讨论】:
-
文件是在 MacOS 上编写的
-
打开(文件名,'r',编码='utf8')
标签: python encoding character-encoding python-unicode