【发布时间】:2017-05-05 18:28:19
【问题描述】:
我将一个 cvs 文件导入到 pandas 中,当我这样做时,前几个名称被正确编码,然后再往下重音变成符号。这是一个相当大的文件,有近 200 个名称。我能做些什么来解决这个问题。
import sys
import codecs
import pandas as pd
import numpy as np
import matplotlib.pylab as plt
#%matplotlib inline
from matplotlib.pylab import rcParams
sys.stdout = codecs.getwriter( "ISO-8859-1" )( sys.stdout.detach() )
rcParams['figure.figsize'] = 15, 6
data = pd.read_csv('IndNames.csv', encoding='ISO-8859-1')
pd.get_option("display.max_rows")
pd.set_option('expand_frame_repr', False)
pd.set_option('display.height', 500)
data.align(data, axis=1)
print(data.head(n=182))
Ex: José
José
编辑:ftfy 不适用于数据框
Edit1:当我将其保存到 csv 文件时,我无法找出问题,一切正常,然后当我使用 pd.read_csv 再次使用它时,它是未编码的。
【问题讨论】:
-
查看
ftfy以检测和修复错误编码的 unicode