【发布时间】:2017-03-15 18:22:25
【问题描述】:
我对 R 很陌生,我无法为以下问题提出适当的解决方案。我有一个如下所示的数据框:
mydf <- data.frame(group1 = c("A", "B", "C", "C", "B", "A"),
group2 = c("B", "A", "A", "B", "C", "C"),
value = c(22, 22, 75, 84, 84, 75))
mydf
我想基本上比较每对行并删除那些带有冗余信息的行,即如果 group1[row_n] 等于 group2[row_m] 并且 group2[row_n] 等于 group1[row_m] 和value[row_n] 等于 value[row_m]。在示例中,最终数据框应如下所示:
final.df <- data.frame(group1 = c("A","C", "C"),
group2 = c("B", "A", "B"),
value = c(22, 84, 75))
final.df
希望有人可以提供帮助。提前致谢。
【问题讨论】:
-
unique(mydf)? -
我认为
unique(mydf)不会起作用,因为第 1 组和第 2 组被视为可互换。