【发布时间】:2015-09-21 14:19:37
【问题描述】:
我正在调用 mllib Statistics.corr() 函数并收到以下错误:
(x: org.apache.spark.api.java.JavaRDD[java.lang.Double],y: org.apache.spark.api.java.JavaRDD[java.lang.Double],method: String) scala.Double (x: org.apache.spark.rdd.RDD[scala.Double],y: org.apache.spark.rdd.RDD[scala.Double],method: String)scala.Double 不能应用于 (org.apache.spark.rdd.RDD[List[scala.Double]], org.apache.spark.rdd.RDD[List[scala.Double]], String)
println(Statistics.corr(a, b, "pearson"))
我需要做什么才能将我的数据类型转换为正确的 corr() 输入类型?
【问题讨论】:
-
请显示
a和b的类型。看起来他们是RDD[List[Double]],但应该是RDD[Double]。 -
如报错所示,确实是RDD[List[Double]]的类型
-
如问题所述,我想知道如何将 RDD[List[Double]] 转换为 RDD[Double]
标签: scala apache-spark