【发布时间】:2017-05-19 15:52:19
【问题描述】:
Pyspark 提供了通过https://github.com/databricks/spark-sklearn 并行化模型交叉验证的绝佳可能性
作为 sklearn 的 GridSearchCV 的简单替换
from spark_sklearn import GridSearchCV
我怎样才能为 Spark 的 Scala CrossValidator 实现类似的功能,即并行化每个折叠?
【问题讨论】:
标签: scala apache-spark cross-validation apache-spark-ml