【问题标题】:Scikit learn cross validation splitScikit 学习交叉验证拆分
【发布时间】:2015-08-06 00:54:18
【问题描述】:

我目前正在使用 cross_validation.cross_val_predict 来获取由 LogisticRegression 分类器做出的预测。我的问题是:构成训练集的数据百分比和构成测试集的百分比是多少?是 80%-20% 的拆分吗?

我在 stackoverflow 上查看了网站和其他问题,但没有找到问题的答案。

【问题讨论】:

    标签: python scikit-learn classification cross-validation


    【解决方案1】:

    documentation for this function 中,它声明为cv arg:

    cv : 交叉验证生成器或 int,可选,默认值:无 要使用的交叉验证生成器。如果是 int,如果 y 是二元或多类并且 estimator 是分类器,则确定 StratifiedKFold 中的折叠数,否则确定 KFold 中的折叠数。如果为 None,则相当于 cv=3。此生成器必须仅包含测试集中的所有元素一次。否则,会引发 ValueError。

    【讨论】:

    • 是的,但他们没有说明在每一折中进入测试集的数据百分比。
    • 不,我认为是:1/3rd。
    • 好吧,我想这是有道理的。这就是我通常的做法,但我在某些地方读到他们的做法不同。无论如何,谢谢!
    猜你喜欢
    • 2021-03-03
    • 1970-01-01
    • 1970-01-01
    • 2020-04-01
    • 2018-12-07
    • 2014-07-16
    • 2021-01-07
    • 2019-06-09
    相关资源
    最近更新 更多