【发布时间】:2018-12-07 16:38:48
【问题描述】:
我想知道当我训练测试拆分(20% 测试,80% 80%)然后我应用 5 折交叉验证时,这是否意味着所有数据都已在测试集中一次?还是每次随机选择,在每个折叠中,相同的事件可能不止一次包含在测试中,有些可能从未包含在测试集中?
#20% of the data will be used as test set
X_train, X_test, y_train, y_test = train_test_split(X, y, test_size=0.2, random_state=seed)
cv_results= cross_val_score(model, X_train, y_train, cv=kfold, scoring=scoring)
【问题讨论】:
标签: python machine-learning scikit-learn data-science