【发布时间】:2016-08-21 10:14:10
【问题描述】:
我通过 spark-shell 评估了以下几行 scala 代码:
val a = sc.parallelize(Array(1,2,3,4,5,6,7,8,9,10))
val b = a.coalesce(1)
b.foreachPartition { p =>
p.map(_ + 1).foreach(println)
p.map(_ * 2).foreach(println)
}
输出如下:
2
3
4
5
6
7
8
9
10
11
为什么分区p在第一个map之后就变空了?
【问题讨论】:
标签: scala apache-spark rdd