【发布时间】:2019-02-24 17:03:27
【问题描述】:
假设我有一个包含 1000 行的数据集。我想把它分成训练集和测试集。我想将前 800 行拆分为训练集,然后将 200 行拆分为测试集。有可能吗?
我的训练和测试拆分的python测试代码是这样的:
from sklearn.cross_validation import train_test_split
xtrain, xtest, ytrain, ytest = train_test_split(x, y, test_size=0.20)
【问题讨论】:
-
如果我理解正确,你不想要 train_test_split 行为的洗牌,如果是这样,你是使用 numpy 还是 pandas,还是其他什么?
-
熊猫。我只是想确保我的前 800 个数据(按顺序)将在火车部分,然后其余 200 个在测试部分。
标签: python-3.x jupyter-notebook