【发布时间】:2016-09-16 20:47:32
【问题描述】:
我知道如何创建一个(可爱的)Pandas 相关表,按相关性排序:
c = df.corr().abs()
np.set_printoptions(threshold='nan')
s = c.unstack()
so = s.order(kind="quicksort")
pprint(so)
这太棒了。
问题是,这会输出整个值矩阵的相关性——对于所有列 x 所有列,在交叉矩阵中。
但是,如果我只想检查一列,例如 df['m'],以了解它与所有其他列的相关性怎么办?
我是否需要创建两个数据框并检查它们之间的相关性?有更快的脚本吗?
【问题讨论】:
标签: python pandas dataframe correlation