【发布时间】:2019-07-12 10:45:52
【问题描述】:
我有一个数据框,我想在其中删除重复的行,但只有当另一列的值对于所有行都相同时,我才想删除它们。 (为了更清楚,我想删除所有行具有相同“数字”值的重复行)
我的数据框有一个例子:
df <- data.frame("Name" = c("a", "a", "b", "b", "b", "c", "c", "c"),
"Number" = c(1, 1, 1, 2, 3, 4, 5, 5), stringsAsFactors = FALSE)
而我期望的结果是:
result <- data.frame("Name" = c("b", "b", "b", "c", "c", "c"),
"Number" = c(1, 2, 3, 4, 5, 5), stringsAsFactors = FALSE)
【问题讨论】:
-
总是更好地复制和粘贴当前和预期输出的样子。无需先运行代码。
-
您可以使用两个不同的函数
library(dplyr)duplicated():来识别重复元素和unique(): 用于提取唯一元素。
标签: r dataframe duplicates