【发布时间】:2019-05-04 07:41:05
【问题描述】:
我有以下数据集,我想对其应用聚类(尤其是 k-means)。
id category value
0 122 A 3
1 122 B 4
2 122 C 9
3 145 A 19
4 145 B 22
5 145 C 90
.
.
.
197 225 A 16
198 225 B 17
199 225 C 12
我想要做的是创建 id 集群。例如,每个集群应该包含一些基于类别值计算的相似性度量的 id。
例如:C1 {122, 145, 148} C2{ 225, 222, 221} ....
你知道如何处理这类问题吗?
【问题讨论】:
-
相似度标准是什么?
标签: python pandas cluster-analysis k-means