【发布时间】:2023-03-31 17:22:01
【问题描述】:
我正在比较不同的聚类方法,我想看看两种不同的方法(或参数集)是否定义了相似的聚类。我的集群被定义为数据框中的分类因素(分类变量)。
如果我使用plot(),x 是分类变量,y 是连续变量,我会得到一个 箱线图。如果我也这样做,但 y 是另一个分类变量,我会得到一些奇怪的 条形图(下图)。您如何解读这位情节之王?
在这个图中,x (df$category1) 有 13 个级别:
[1] "A" "B" "C" "D" "cluster1" "cluster5"
[7] "cluster2" "cluster8" "cluster0" "cluster6" "cluster4" "cluster3"
[13] "cluster7"
而 y (df$category2) 只有 12 个级别:
[1] "A" "B" "C" "D" "cluster5" "cluster0"
[7] "cluster4" "cluster2" "cluster3" "cluster6" "cluster1" "cluster7"
两列之间的 A、B、C 和 D 相同,其余的如果集群不一定相同,因为不同集群运行的结果。
编辑:使用的代码是plot(df$category1, df$category2)
【问题讨论】:
-
你用什么代码来创建这个?
-
plot(df$category1, df$category2) -
同时描述你希望情节讲述的故事。
-
@pedrosaurio:这仍然无法重现您的问题。您需要提供样本数据。对于两个分类变量,你会得到一个脊椎图,尽管默认的脊椎图看起来不像你的情节。