【发布时间】:2018-01-11 23:39:45
【问题描述】:
我有一个带有许多列的 pandas 数据框 df,我只想处理我尝试过的对象数据类型的列
from sklearn.preprocessing import FunctionTransformer
get_cat=FunctionTransformer(lambda x:x if x.dtype==np.dtype(object) else None,validate=False)
get_cat.fit_transform(df)
但我遇到了错误
AttributeError: 'DataFrame' object has no attribute 'dtype'
但如果我对列名进行与
相同的操作get_cat=FunctionTransformer(lambda x:x[[col_names]],validate=False)
它工作正常。 我正在使用函数转换器来获取 sklearn Pipline 中的数据以进行机器学习。
【问题讨论】:
-
那么你的问题是什么?添加更多细节,如果可能的话,添加更多代码。
-
我更新了我的问题。
标签: python pandas scikit-learn sklearn-pandas