【发布时间】:2017-09-16 12:50:24
【问题描述】:
我需要一些帮助来过滤数据框。
df 有几列,我想把它分成两个数据框:
1- 仅包括第一列重复的行(包括所有副本)。
2- 其余行,不重复。
这是一个例子: 这将是原始的。
V1 V2
[1,] "A" "1"
[2,] "B" "1"
[3,] "A" "1"
[4,] "C" "2"
[5,] "D" "3"
[6,] "D" "4"
我想变成这样:
V1 V2
[1,] "A" "1"
[2,] "A" "1"
[3,] "D" "3"
[4,] "D" "4"
还有这个:
V1 V2
[1,] "B" "1"
[2,] "C" "2"
有没有办法做到这一点?我曾尝试导出到 Excel,但数据集太大而无法实现。
谢谢
【问题讨论】:
-
你能提供一个可重现的数据集,以及想要的结果吗? stackoverflow.com/questions/5963269/…
-
第一部分你可以使用 base::duplicated()
标签: r filter duplicates