【发布时间】:2015-01-14 06:26:34
【问题描述】:
我有一个数据框,我想在其中比较一组行并仅在整个组相同时才删除。例如:
df<-data.frame(X=c("a", "a", "a", "b", "b", "b", "c", "c", "c"), Y=c(1,2,1,2,2,2,1,2,1), Z=c("ABC","DEF","ABC", "DEF", "DEF", "DEF", "ABC", "DEF", "ABC"))
X Y Z
1 a 1 ABC
2 a 2 DEF
3 a 1 ABC
4 b 2 DEF
5 b 2 DEF
6 b 2 DEF
7 c 1 ABC
8 c 2 DEF
9 c 1 ABC
这里的组由 X 列标识,我想在不同的组之间进行比较。因此,这里的组 a 和组 c 是相同的。我想得到如下最终想要的结果:
GroupID Y Z
1 1 1 ABC
2 1 2 DEF
3 1 1 ABC
4 2 2 DEF
5 2 2 DEF
6 2 2 DEF
知道如何进行这种比较吗?
【问题讨论】:
-
那么,df
-
@OliverKeyes 这将逐行删除,在这种情况下它将返回 5 行。在上面的预期答案中,有 6 行。
-
那么,您希望为 X 的每个唯一值检索不同的 (Y,Z) 元组?