【发布时间】:2018-10-25 08:08:09
【问题描述】:
我有一个包含 3 列和很多行的大 csv 文件。 它看起来像这样:enter image description here
现在我想将 ID1 的所有行分组并在 C 中获取它们的值的平均值。
我的代码如下所示:
import pandas as pd
import numpy as np
df = pd.read_csv('file.csv', sep=";",decimal=",", index_col=0)
grouped = df.groupby(['A'])[['C']]
grouped.mean()
运行代码时出现此错误:
但在 csv 文件中,我确保没有 NaN 和非数值。
对此我能做些什么?非常感谢!
DataError:没有要聚合的数字类型
【问题讨论】:
-
df['C']的dtype是什么? -
它说(非空)对象,我想我需要像 int64 或 float 64 这样的东西,函数 .mean() 才能工作,对吧?有没有一种方法可以更改 dtype 而不会破坏“C”中的数据?
标签: python csv pandas-groupby