【发布时间】:2020-12-21 23:33:07
【问题描述】:
我正在进行聚类分析,当我完成绘图时标签出现问题。我一直在网上查看解决方案,但我什么也做不了。
我尝试使用以下方法保留标签:
rownames(df) <- df$labels
但是当我更改比例时,行名被删除...
我有另一个带有 ID 的列。但是有标签会更好。
可以通过任何方式使用我的 ID 和标签加入结果。问题是 fviz_cluster 适用于行名吗?
我有将近 100 个 n。
我对此很业余。对此感到抱歉。非常感谢
structure(list(label = c("A1", "A2", "A3", "B1", "B2", "B3",
"C1", "C2", "C3"), ID = c(9, 44, 55, 57, 64, 59, 61, 20, 29),
A = c(1, 1, 1, 1, 2, 2, 2, 1, 1), B = c(1, 1, 1, 1, 1, 6,
6, 4, 4), C = c(0, 0, 1, 1, 3, 1, 3, 1, 2)), row.names = c("A1",
"A2", "A3", "B1", "B2", "B3", "C1", "C2", "C3"), class = c("tbl_df",
"tbl", "data.frame"))
demo <- as.data.frame(df)
rownames(demo) <- demo$label
head (demo) *#Ok, I have the labels in rownames!*
# A tibble: 6 x 5
label ID A B C
<chr> <dbl> <dbl> <dbl> <dbl>
1 A1 9 1 1 0
2 A2 44 1 1 0
3 A3 55 1 1 1
4 B1 57 1 1 1
5 B2 64 2 1 3
6 B3 59 2 6 1
我需要缩放数据...在这一步中我丢失了行名,下一步我无法使用 “演示”数据,因为我需要一个没有标签的表格...
demo1 <- scale(demo[c('A','B', 'C')])
A B C
[1,] -0.6666667 -0.7995005 -1.1925696
[2,] -0.6666667 -0.7995005 -1.1925696
[3,] -0.6666667 -0.7995005 -0.2981424
[4,] -0.6666667 -0.7995005 -0.2981424
[5,] 1.3333333 -0.7995005 1.4907120
[6,] 1.3333333 1.4490946 -0.2981424
fviz_nbclust(demo1, pam, method = "wss")
pam <- pam(demo1, 2)
print(pam)
fviz_cluster(pam, data = demo1, ellipse.type = "norm", )
【问题讨论】:
标签: r label cluster-analysis