【发布时间】:2019-11-11 16:52:40
【问题描述】:
我有一个数据框,如果其关联索引的计数小于 2,我想在其中过滤掉月份值。
ID = c(rep("A", 5), rep("B", 5))
Month = c(
1,
1,
2,
2,
3,
1,
2,
2,
3,
3
)
Index = c("X1", "X1", "X2", "X2", "X3", "X1", "X2", "X2", "X2", "X3")
df = data.frame(ID, Month, Index, stringsAsFactors = FALSE)
df$Month <- as.factor(df$Month)
df
这里,X3 和 X1 只针对 A 和 B 分别出现一次,因此这些行将被删除。
但是,如果我尝试使用 %in% 过滤 X3 和 X1 的数据,它们也会从其他 ID 值中删除。
删除应该只针对特定组。
【问题讨论】:
-
这能回答你的问题吗? Using filter with count
-
这里有一个 very 对不同方法的深入比较可能会有所帮助:stackoverflow.com/q/43110349/5325862。这里还有很多选择:stackoverflow.com/q/20204257/5325862
标签: r dplyr subset data-manipulation