【发布时间】:2016-09-29 08:54:47
【问题描述】:
我正在尝试使 Blaze 数据对象适合 scikit kmeans 函数。
from blaze import *
from sklearn.cluster import KMeans
data_numeric = Data('data.csv')
data_cluster = KMeans(n_clusters=5)
data_cluster.fit(data_numeric)
数据样本:
A B C
1 32 34
5 57 92
89 67 21
它的抛出错误:
我已经能够使用 Pandas Dataframe 做到这一点。有什么方法可以将 blaze 对象提供给这个函数?
【问题讨论】:
-
仔细检查您传递给 k-means 的数组的大小。通常在传递一维数组时会引发此错误。
-
你的 blaze 对象中有多少个样本?
标签: python scikit-learn blaze