【发布时间】:2018-03-07 00:21:51
【问题描述】:
我是 Spark 的新手,正在尝试在 scala 中编写代码。我有一个 RDD,其中包含以下形式的数据:
1: 2 3 5 2:5 6 7 3:1 8 9 4:1 2 4
还有一个 [1,4,8,9] 形式的列表
我需要过滤 RDD,使其包含列表中存在 ':' 之前的值或列表中存在 ':' 之后的任何值的那些行。
我写了以下代码:
val links = linksFile.filter(t => {
val l = t.split(": ")
root.contains(l(0).toInt) ||
for(x<-l(0).split(" ")){
root.contains(x.toInt)
}
})
linksFile 是 RDD,root 是列表。
但这不起作用。有什么建议吗??
【问题讨论】:
标签: scala apache-spark filter rdd