【发布时间】:2018-09-27 04:55:33
【问题描述】:
我有一个名为 df_noyau_yes 的数据集,我想应用 ShuffleSplit 将其拆分为训练集和测试集以训练自动编码器。
问题是这个函数返回洗牌数据的索引,我试图提取这些索引的数据以将它们提供给自动编码器,但它不起作用,它显示错误KeyError 223
代码如下:
rs = ShuffleSplit(n_splits=2, test_size=.25, random_state=0)
rs.get_n_splits(df_noyau_yes)
for train_index, test_index in rs.split(df_noyau_yes):
print("TRAIN:", train_index, "TEST:", test_index)
#X_train, X_test = df_noyau_yes[train_index], df_noyau_yes[test_index]
x_train=[]
for x in train_index:
x_train = np.append(x_train, df_noyau_yes[x])
print(x_train)
print("training set",x_train)
有什么解决办法吗??
【问题讨论】:
-
df_noyau_yes 是熊猫数据框吗?如果是,那么您无法像在此处那样通过简单的索引来访问样本。
-
是的,它是一个熊猫数据框。那我该怎么做呢?
-
问题解决了吗?
标签: python split sklearn-pandas autoencoder