【问题标题】:Kmeans cluster evaluationKmeans 聚类评估
【发布时间】:2017-06-08 19:12:42
【问题描述】:

我对集群评估中的 SSB 计算有点困惑

在哪里

|Ci| is the size of cluster i
ci is the centroid of cluster i
c is the centroid of the overall data 

这个“整体数据的质心”是什么? 到处都提到它作为整体数据的质心。

是我们计算的初始质心吗?

编辑

从匿名慕斯的回答中得到更多的澄清。

假设我们在聚类中进行了 1 次迭代。

step 1: k =2, select random centroids(Let my random centroids be (2,1,3) and (3,1,1))
step 2: do clustering(Now 2 clusters are formed)
step 3: then find new centroids(by averaging data for each cluster, After averaging let my new clusters be (2.3,1.5,3) and (6.7,1,2))

所以现在我需要计算 SSB。

现在我需要计算整个数据(输入数据)的质心,让该值为 (25,30.5,78)

total no of values in c1 = 20
total no of values in c2 = 30

ssbc1 = 20*(dist([2.3,1.5,3],[25,30.5,78]))^2
ssbc1 = 30*(dist([6.7,1,2],[25,30.5,78]))^2
total ssb = ssbc1+ssbc2

是这样的吗?

【问题讨论】:

    标签: cluster-analysis k-means


    【解决方案1】:

    质心是每个维度的平均值。

    “在所有数据中”表示使用聚类。

    【讨论】:

      猜你喜欢
      • 2021-06-10
      • 2012-02-24
      • 2018-06-07
      • 2015-03-06
      • 2018-10-14
      • 2015-07-29
      • 2013-11-18
      • 1970-01-01
      • 2015-02-20
      相关资源
      最近更新 更多