【发布时间】:2011-12-23 07:12:24
【问题描述】:
我有以下变量列 -
var1 <- c("a", "b", "a", "a", "c", "a", "b", "b", "c", "b", "c", "c", "d")
var2 <- c("a", "a", "b", "c", "a", "d", "b", "c", "b", "d", "c", "d", "d")
mydf <- data.frame(var1, var2)
我想找到唯一的变量组合,这样
(a) var1 a- var2 b and var1 b- var2 a are not considered unique.
(b) no identical combination are present -
for example var1 a and var2 a, var1 b and var2 b
我使用了以下代码,但没有提供我所期望的:
unique(mydf)
var1 var2
1 a a
2 b a
3 a b
4 a c
5 c a
6 a d
7 b b
8 b c
9 c b
10 b d
11 c c
12 c d
13 d d
我的预期输出是:
var1 var2
1 a b
2 a c
3 a d
4 b c
5 b d
6 c d
谢谢;
【问题讨论】:
-
我认为以下工作,
library(plyr) ; ddply(mydf, .(var1), subset, var1 < var2)
标签: r variables conditional unique