【发布时间】:2018-01-29 14:01:32
【问题描述】:
我在 spark 中工作,我必须从 List 的元素创建一个 RDD[(Double, Double)]
我有
val list1: List[Double] = List(16.0,5.0)
当我这样做时
val rdd = sc.parallelize (Seq(list1))
我得到一个 RDD[List[Double]] 类型的 RDD
但我想要一个RDD[(Double, Double)] 类型的RDD,我可以通过这样做来实现:
val rdd = sc.parallelize (Seq((16.0,5.0)))
所以基本上,我如何在Seq() 中列出我列表中的所有元素而不进行迭代并执行类似的操作:
val rdd = sc.parallelize (Seq((list1(*))))
【问题讨论】:
-
我很困惑。在这种情况下,您的预期输出是什么?
RDD[(16.0, 5.0)]如果你有3, 4, or n元素会怎样? -
(Seq((16.0,5.0)))不是包含List的Seq。这是一个Seq元组(在本例中为 Tuple2)。 -
这是另一个关于我详细用法的问题:stackoverflow.com/questions/48502410/…
标签: scala list apache-spark rdd