【问题标题】:Clusters features median values using Python使用 Python 的集群具有中值
【发布时间】:2018-05-28 15:38:38
【问题描述】:

在处理数据集时,我使用了 k-means 聚类,我想探索特征/变量的中值。

data = pd.DataFrame({'Monetary': rfm_m_log,'Recency': rfm_r_log,'Frequency': rfm_f_log})
matrix = data.as_matrix()    
kmeans = KMeans(init='k-means++', n_clusters = 2, n_init=30)
kmeans.fit(matrix)
clusters_customers = kmeans.predict(matrix)

如何打印每个集群中货币、新近度和频率的中值? (集群 1 和集群 2)

【问题讨论】:

  • 集群质心比中值有用吗?
  • 是的,它很有用

标签: python scikit-learn k-means


【解决方案1】:

可以根据实际分类对数据框进行切片:

# class 0 median of the Monetary column
data.iloc[np.argwhere(clusters_customers == 0).ravel()]['Monetary'].median()

# class 1 median of the Monetary column
data.iloc[np.argwhere(clusters_customers == 1).ravel()]['Monetary'].median()

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2015-11-21
    • 2015-01-08
    • 2020-03-29
    • 2020-08-16
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2018-09-01
    相关资源
    最近更新 更多