【发布时间】:2017-02-08 17:59:06
【问题描述】:
我有一个包含 400 列左右的数据框,我想根据我的要求删除 100 列。 所以我创建了一个包含 100 个列名的 Scala 列表。 然后我想遍历一个 for 循环以在每个 for 循环迭代中实际删除列。
下面是代码。
final val dropList: List[String] = List("Col1","Col2",...."Col100”)
def drpColsfunc(inputDF: DataFrame): DataFrame = {
for (i <- 0 to dropList.length - 1) {
val returnDF = inputDF.drop(dropList(i))
}
return returnDF
}
val test_df = drpColsfunc(input_dataframe)
test_df.show(5)
【问题讨论】:
-
我收到无法解析“returnDF”的编译错误。谁能帮忙解决这个问题。
-
请让问题自成一体。您为什么将部分问题放在 cmets 中? How do I ask a good question?
-
请edit您的问题以及您在 cmets 中添加的其他信息!
-
@Martin 和 Eliasah-- 完成问题中的更改。谢谢
-
我在上面的代码中遇到的问题是,我得到一个编译错误,“无法解析'returnDF'”。谁能帮忙解决这个问题。
标签: scala apache-spark apache-spark-sql