【发布时间】:2012-09-12 22:26:57
【问题描述】:
我尝试使用 pandas.read_csv 读取缺失值的 .txt。我的数据格式为:
10/08/2012,12:10:10,name1,0.81,4.02,50;18.5701400N,4;07.7693770E,7.92,10.50,0.0106,4.30,0.0301
10/08/2012,12:10:11,name2,,,,,10.87,1.40,0.0099,9.70,0.0686
包含数千个具有相同名称的点、gps 位置和其他读数的样本。 我使用代码:
myData = read_csv('~/data.txt', sep=',', na_values='')
代码错误,因为 na_values 没有给出 NaN 或其他指标。列应该具有相同的大小,但我以不同的长度完成。
我不知道在 na_values 之后应该输入什么(确实尝试了所有不同的东西)。 谢谢
【问题讨论】:
-
如果你
skiprows=1,那么文件中只有一行。如果没有该参数,我会在 DataFrame 中看到清晰的NaNs。 -
我只发布了两行数据以显示其格式。 skiprows=1 不会对丢失的数据做任何事情,在原始文件中有 15000 行,第一行包含一些我不想要的名称。
-
为了清楚起见,我删除了
skiprows=1