【发布时间】:2017-01-14 12:55:26
【问题描述】:
我正在使用 Spark 2.0 和新的 spark.ml。包。 有没有办法调整分类阈值,以便减少误报的数量。 如果重要的话,我也在使用 CrossValidator。
我看到 RandomForestClassifier 和 DecisionTreeClassifier 都输出一个概率列(我可以手动使用,但 GBTClassifier 没有。
【问题讨论】:
标签: apache-spark apache-spark-mllib decision-tree