【发布时间】:2018-02-13 22:21:31
【问题描述】:
我正在尝试在维护索引的同时绘制 train_test _split,这是我的代码。
#df.insert(0, 'x', range(0, 0 + len(df)))
X_train, X_test, y_train, y_test = train_test_split(x, y,
test_size = .1)
regressor = RandomForestClassifier()
regressor.fit(X_train, y_train)
y_pred = regressor.predict(X_test)
plt.plot(X_train,y_pred_train,'bo')
plt.show()
似乎 y_pred 正在针对不正确的 x_axis 值进行绘图,因为数据中间存在巨大差距并且有些重叠
如何使 y_pred 和 y_pred_train 对应的 x_value 位于数据框中的原始位置。
【问题讨论】:
-
用
X_test代替df[x]怎么样? -
请分享一些您的数据样本
-
然后分享生成这些的代码
-
@VivekKumar 检查新更新
标签: python matlab plot machine-learning scikit-learn