【发布时间】:2017-12-14 23:42:22
【问题描述】:
我有一个如下所示的数据框:
id date time
1 1 15-12-15 10:30
2 2 15-12-15 08:30
3 3 16-12-15 10:30
4 1 16-12-15 08:30
可以这样创建:
df <- data.frame(id=c(1,2,3,1),
date=c("15-12-15", "15-12-15", "16-12-15", "16-12-15"),
time=c("10:30", "08:30", "10:30", "08:30"))
我想删除所有具有重复 id 的行。如果发现重复项,那么我想保留最先出现的id(按日期和时间),并删除所有其他人
我目前的做法是按date排序,然后:
df <- subset(df, duplicated(df$id) == FALSE)
因此,这将保留 id 不重复但保留标准不明确的所有行。它似乎只保留按日期排序时遇到的第一次出现?
有没有一种方法可以做到这一点而不必先进行日期排序?
【问题讨论】:
标签: r sorting dataframe subset