【发布时间】:2014-07-22 08:01:58
【问题描述】:
我有一个有重复观察的data.frame,我如何删除所有重复的基于第一列(如果他们的第一个数据相同,然后完全删除这些条目)?
> a=c(1,4,5,5,6,6)
> b=c(2,5,7,4,4,2)
> c=c("a","b","c","a","b","c")
> test=data.frame(a,b,c)
> test
a b c
1 1 2 a
2 4 5 b
3 5 7 c
4 5 4 a
5 6 4 b
6 6 2 c
我不想保留任何重复的行,以便我的最终输出是
a b c
1 1 2 a
2 4 5 b
我尝试过unique 和duplicate 函数,但它们都保留了第一个重复行(即,如果有 5 条重复记录,则其中 4 条将被删除),例如
a b c
1 1 2 a
2 4 5 b
3 5 7 c
4 6 4 b
我该怎么办?谢谢!
【问题讨论】:
-
我不明白为什么你的最终输出应该是这样的。我不明白你为什么认为其他行是重复的
-
6 4 b是如何重复的?为什么要删除它 -
@Pop 我的意思是基于第一列的重复项。第 3 行和第 4 行的 [,1] 为 5,第 5 行和第 6 行的 [,1] 为 6。
-
@Floo0 因为下一行
6 2 c也以6开头。
标签: r