【发布时间】:2019-10-31 15:53:15
【问题描述】:
我将包含各种功能的 pandas DataFrame 传递给 sklearn,我不希望估算器使用数据帧索引作为功能之一。 sklearn 是否使用索引作为特征之一?
df_features = pd.DataFrame(columns=["feat1", "feat2", "target"])
# Populate the dataframe (not shown here)
y = df_features["target"]
X = df_features.drop(columns=["target"])
estimator = RandomForestClassifier()
estimator.fit(X, y)
【问题讨论】:
-
不,它没有,它将数据框下方的数组作为您的输入。您可以通过
print(X.to_numpy())进行检查 -
谢谢@Erfan。你会碰巧知道这发生在 scikit-learn 源代码的什么地方吗?我搜索了“to_numpy”的代码,没有找到。
标签: pandas scikit-learn