【发布时间】:2016-06-02 12:25:51
【问题描述】:
我想计算两个不同值的每列出现的次数,第一个是 null 的数量,第二个是我的数据框中 \N 的数量。我的例子:
A B C D E D
1 \N 1 \N 12 1
2 4 \N 3 0 \N
3 4 M \N 1
我希望得到以下结果:
A 2
B 1
C 2
D 1
E 1
F 2
我已经用下面的代码成功统计了缺失值的个数:
df = pd.read_csv("mypath/myFile", sep=',')
null_value = df.isnull().sum()
但是下面的代码不起作用:
break_line = df[df == '\N'].count()
return break_line + null_value
我收到以下错误
TypeError: 无法将 ['\N'] 与块值进行比较
【问题讨论】:
标签: python csv pandas missing-data