【发布时间】:2017-06-17 00:51:13
【问题描述】:
我需要类似于 randomSplit 函数的东西:
val Array(df1, df2) = myDataFrame.randomSplit(Array(0.6, 0.4))
但是,我需要根据布尔条件拆分 myDataFrame。是否存在类似以下内容?
val Array(df1, df2) = myDataFrame.booleanSplit(col("myColumn") > 100)
我不想做两个单独的 .filter 调用。
【问题讨论】:
标签: scala apache-spark dataframe apache-spark-sql