【发布时间】:2017-03-08 03:45:53
【问题描述】:
我是 Spark-scala 的新手,试图解决简单的字数问题(具有多个属性作为键)。我可以得到一些输入吗? 我有一个 Rdd(String,String,Long) 喜欢 (a,b,1) (a,c,1) (a,c,1) (b,b,1) (b,b,1)
期望的结果是一个类似 rdd (a,b,1) (a,c,2) (b,b,2)
【问题讨论】:
标签: scala apache-spark word-count bigdata
我是 Spark-scala 的新手,试图解决简单的字数问题(具有多个属性作为键)。我可以得到一些输入吗? 我有一个 Rdd(String,String,Long) 喜欢 (a,b,1) (a,c,1) (a,c,1) (b,b,1) (b,b,1)
期望的结果是一个类似 rdd (a,b,1) (a,c,2) (b,b,2)
【问题讨论】:
标签: scala apache-spark word-count bigdata
试试:
rdd.map {
case (x, y, c) => ((x, y), c)
}.reduceByKey(_ + _)
【讨论】: