【发布时间】:2014-07-15 09:15:24
【问题描述】:
我有一个 CSV 文件如下:
id,at1,at2,at3
1072,0.5,0.2,0.7
1092,0.2,0.5,0.7
...
我已经将它加载到 Weka 中进行聚类:
DataSource source = new DataSource("test.csv");
Instances data = source.getDataSet();
kmeans.buildClusterer(data);
问题 #1:如何将第一列设置为 ID? IE。出于聚类目的而忽略第一列。
然后我尝试打印出作业:
int[] assignments = kmeans.getAssignments();
int i = 0;
for (int clusterNum : assignments) {
System.out.printf("Instance %d -> Cluster %d \n", i, clusterNum);
i++;
}
打印出来:
Instance 1 -> Cluster 0
Instance 2 -> Cluster 2
...
问题 #2: 在打印作业时如何参考 ID?例如:
Instance 1072 -> Cluster 0
Instance 1092 -> Cluster 2
【问题讨论】:
标签: java cluster-analysis weka k-means