【发布时间】:2014-07-24 11:09:40
【问题描述】:
我想对 R 中缺少分类值和数值的数据集执行营销细分聚类。由于缺少值,我无法执行 k-means 聚类。
R 版本 3.1.0 (2014-04-10)
平台:x86_64-apple-darwin13.1.0(64 位)
Mac OSX 10.9.3 4GB 硬盘
R 中是否有可以适应部分填充率的聚类算法包?查看有关缺失值的学术文章,研究人员为特殊用例创建了一种新算法,并且包在 R 中不可用。例如,具有软约束的 k-means 和具有部分距离策略的 k-means 聚类。
我有 36 个变量,但这里是前 5 个变量的描述:
head(df)
user_id Age Gender Household.Income Marital.Status
1 12945 Male
2 12947 Male
3 12990
4 13160 25-34 Male 100k-125k Single
5 13195 Male 75k-100k Single
6 13286
如果我可以提供更多信息,请告诉我。
【问题讨论】:
-
@EDi,在传统聚类方法之前,面向矩阵的方法存在可扩展性问题。我收到一个关于无法分配特定大小的向量的错误。
标签: r machine-learning cluster-analysis missing-data