【发布时间】:2017-03-05 11:03:18
【问题描述】:
我正在尝试比较 pandas.DataFrame.pivot_table() 和 pandas.DataFrame.groupby。我有一个关于技巧的经典数据集:
import pandas as pd
url = 'https://raw.github.com/pandas-dev/pandas/master/pandas/tests/data/tips.csv'
tips = pd.read_csv(url)
现在,我只想聚合 tip_pct 和 size,并按天分组。我会将吸烟者放在表格列中,将日期放在行中。通过使用pivot_table,我可以做到这一点:
tips.pivot_table(['tip_pct', 'size'], index=['sex', 'day'], columns='smoker')
但是现在我如何使用groupby 完成这项任务?我试过了,但结果不如预期:
tips.groupby(['sex', 'day'])['tip_pct', 'size'].mean()
【问题讨论】:
标签: python pandas pivot-table