【发布时间】:2014-01-06 01:37:33
【问题描述】:
我有一个使用 Numpy 读取制表符分隔的文本文件创建的矩阵,它看起来像这样:
sample category_a category_b value
------ ---------- ---------- -----
1 A Z 3.92
2 A Y 12.43
3 B Z 5.87
4 B Y 6.71
etc...
我想过滤或分组数据以执行一些基本统计,例如计算单个类别或类别组合的每个值的平均值。不幸的是,我是 Numpy 的新手,并且在文档中没有看到对此类功能的任何明显参考。是否可以按类别对矩阵数据进行分组并执行计算?或者我需要在从文件中读取数据时过滤进入矩阵的数据然后进行计算?
【问题讨论】:
-
您可以像这样过滤数据:stackoverflow.com/questions/3030480/…这里还有一些内置功能的参考,也许其中一个功能可以满足您的需求:docs.scipy.org/doc/numpy/reference/routines.sort.html
-
我建议你看看
pandas。 -
@BrenBarn:看起来它可能比基础 Numpy 更适合我需要做的事情。谢谢!
标签: python numpy matrix statistics