【发布时间】:2017-06-17 08:51:13
【问题描述】:
我在 spark sql 中有一个由以下 csv 文件组成的数据框:
客户、桶、频率
A,3,4
A,2,1
A,1,4
B,1,3
B,3,4
B,2,4
C,3,1
C,2,1
C,4,1
D,2,3
D,4,5
D,1,5
对于每个客户,我想要与最大频率对应的最小桶数。所需的输出:
客户,桶
A,1
B,2
C,2
D,1
任何帮助将不胜感激。谢谢朋友!!
【问题讨论】:
标签: scala apache-spark apache-spark-sql spark-dataframe bigdata