【发布时间】:2015-11-26 13:18:34
【问题描述】:
类似于this question,我有一个数据框,想提取几个特定列中的值组合不唯一的行。
例如,我有一个数据框 df:
> df<-data.frame(c(1,2,3,4),c(T,F,T,T),c("a","b","c","b"),c("b","d","e","a"))
> df
[,1] [,2] [,3] [,4]
[1,] "1" "TRUE" "a" "b"
[2,] "2" "FALSE" "b" "d"
[3,] "3" "TRUE" "c" "e"
[4,] "4" "TRUE" "b" "a"
我想测试第 2、3 和 4 列中的值组合对于数据框的行是唯一的还是重复的。但是,我不想将第一次出现的组合归类为唯一组合,并将所有后续组合归类为重复组合,而是将所有出现的非唯一组合归为重复组合。
在此示例中,第 1 行和第 4 行是重复的,第 2 行和第 3 行在第 2、3 和 4 列中的值组合中是唯一的。
任何帮助将不胜感激。
【问题讨论】:
-
你的 data.frame 是一个矩阵。使用
data.frame而不是cbind创建data.frame。