【发布时间】:2020-01-24 14:46:57
【问题描述】:
我有一个用于机器学习数据集的数据集。下面列出了我的数据框。
数据框 = df
memid year code1 code2 ....... n amount of columns
1 2014 8888 654
2 2016 13456 4353
2 2016 12345 3333
1 2014 123333 1111
1 2016 55555 2222
1 2016 99999 2222
我的目标是汇总数据集并将年份作为列名中的度量添加到整个数据框(即 n 列)我下面的表结构是我的目标
以下目标数据框:
memid code1_2014 code1_2015 code1_2016 code2_2014 code2_2015 code2_2016
1 8888, 123333 55555, 99999 654, 1111 2222
2 13456, 12345 4353, 3333
这段代码的目标是为数据集中除memid之外的所有列实现上述列结构。我知道这是一个复杂的 groupby 和 .apply 或 join 方法,但是我无法实现目标。
请帮忙! 谢谢!
【问题讨论】:
标签: pandas numpy pandas-groupby apply