【发布时间】:2020-07-16 18:33:45
【问题描述】:
我正在将 sklearn 用于机器学习项目,其中一列采用分类形式。我想用序数编码器将其转换为数字形式,然后估算丢失的数据。 Sklearn的OrdinalEncoder报错:
ValueError: Input contains NaN
但我真的不想先使用分类输入器,然后将值转换为数字,因为它不太适合数据的性质。有没有办法解决这个问题?
代码如下:
from sklearn.preprocessing import OrdinalEncoder
ordinalenc = OrdinalEncoder()
imd = ordinalenc.fit_transform(info[["imd_band"]])
print(ordinalenc.categories_)
【问题讨论】:
标签: python scikit-learn imputation