【发布时间】:2020-12-15 06:33:22
【问题描述】:
我正在尝试根据第一个和最后一个日期按组计算列的行之间的差异。 例如:
df = pd.DataFrame({'ID':["a","a","a","b","b","b"],
'start_yr':[2010,2013,2020,2009,2005,2019],
'amt':[10,40,30,50,60,100]})
应该返回
a 20 (30-10)
b 40 (100 - 60)
我已经尝试过这样的东西,但我肯定错过了一些东西。
#df['diff'] = df.groupby('ID')['start_yr','amt'].transform(lambda x: (x.max()-x.min()))
df['diff'] = dThe f.groupby('ID')['start_yr'].transform(lambda x: (x.max()-x.min()))
【问题讨论】:
标签: python pandas date pandas-groupby subtraction