【发布时间】:2020-08-03 09:14:02
【问题描述】:
这应该很简单,但我是使用 python 工作的新手。请问有什么建议吗?
#original dataframe
df = pd.DataFrame({'year':[1,1,1,1,1],
'month':[4,4,4,4,4],
'mode': ['a','b','a','a','b']},
columns=['year','month','mode'])
#pivot/groupby etc
# df2=df.pivot(columns=('year','month'), values=('mode')).count()
#create this dataframe
df2 = pd.DataFrame({'year':[1],
'month':[4],
'a': [3],
'b':[2]},
columns=['year','month','a','b'])
我在 Koalas Apache Spark 环境 (documentation) 中工作,所以解决方案应该可以解决。
【问题讨论】:
-
df.pivot_table(index=['year','month'], aggfunc='size', columns='mode') -
谢谢,如果您作为答案发布,我会接受它以防它帮助其他人
标签: python apache-spark group-by pivot