【发布时间】:2021-10-12 15:18:00
【问题描述】:
考虑以下数据集。数据按每组一或两个人分组。但是,一个人可能有多个条目。
group<-c(1,1,1,1,2,2,3,3,3,3,4,4)
individualID<-c(1,1,2,2,3,3,5,5,6,6,7,7)
X<-rbinom(12,1,0.5)
df1<-data.frame(group,individualID,X)
> df1
group individualID X
1 1 1 0
2 1 1 1
3 1 2 1
4 1 2 1
5 2 3 1
6 2 3 1
7 3 5 1
8 3 5 1
9 3 6 1
10 3 6 1
11 4 7 0
12 4 7 1
从上述第 1 组和第 3 组有 2 个人,而第 2 组和第 4 组各有 1 个人。
> aggregate(data = df1, individualID ~ group, function(x) length(unique(x)))
group individualID
1 1 2
2 2 1
3 3 2
4 4 1
如何在不使用 dplyr 包的情况下对数据进行子集化,以仅拥有超过 1 个个人的组。即省略有 1 个人的组。
我最终应该只有第 1 组和第 3 组。
【问题讨论】:
标签: r