【发布时间】:2016-06-10 15:03:44
【问题描述】:
我有一个完全由布尔变量组成的数据集。与下面转换后的动物数据集完全一样,只是有更多列。
# http://stats.stackexchange.com/questions/27323/cluster-analysis-of-boolean-vectors-in-r
library(cluster)
head(mona(animals)[[1]])
war fly ver end gro hai
ant 0 0 0 0 1 0
bee 0 1 0 0 1 1
cat 1 0 1 0 0 1
cpl 0 0 0 0 0 1
chi 1 0 1 1 1 1
cow 1 0 1 0 1 1
我们的目标是重新排列行,以便更容易在视觉上识别相似成员模式的分组。
我认为某种聚类算法可能是可行的方法,但我不确定要使用哪些函数或如何准确地进行。
理想情况下,该表将被绘制为一种棋盘格。用阴影方块表示每个点是真还是假。
【问题讨论】:
标签: r ggplot2 cluster-analysis data-visualization hierarchical-clustering