【发布时间】:2014-03-27 16:24:47
【问题描述】:
我对 Python 和 Pandas 还很陌生,并试图弄清楚如何进行简单的拆分连接应用。我遇到的问题是,我从 Pandas 的应用功能返回的所有数据帧的顶部都有一个空白行,我不知道为什么。谁能解释一下?
以下是演示问题的最小示例,而不是我的实际代码:
sorbet = pd.DataFrame({
'flavour': ['orange', 'orange', 'lemon', 'lemon'],
'niceosity' : [4, 5, 7, 8]})
def calc_vals(df, target) :
return pd.Series({'total' : df[target].count(), 'mean' : df[target].mean()})
sorbet_grouped = sorbet.groupby('flavour')
sorbet_vals = sorbet_grouped.apply(calc_vals, target='niceosity')
如果我再做print(sorted_vals) 我得到这个输出:
mean total
flavour <--- Why are there spaces here?
lemon 7.5 2
orange 4.5 2
[2 rows x 2 columns]
将此与print(sorbet)进行比较:
flavour niceosity <--- Note how column names line up
0 orange 4
1 orange 5
2 lemon 7
3 lemon 8
[4 rows x 2 columns]
造成这种差异的原因是什么,我该如何解决?
【问题讨论】:
标签: python python-3.x pandas