【发布时间】:2019-11-19 11:34:34
【问题描述】:
识别并仅保留 r 中具有重复元素的行
我有一个包含 20 多列的大 df,我需要识别并保留包含来自指定列的重复元素的行。我的方法是创建两个新列。第一列将是串联的元素。第二列将是一个二进制,告诉我第一列中的数据是否重复。我的 df 看起来像这样:
对于我尝试的第一列:
res1 <-mutate(Prac_df, Con_cat =apply(Prac_df[order(PIn, Age, Sex),], 1, function(x) paste0(x, collapse = "_")))
我认为这不起作用,我不确定如何创建运行逻辑回归所需的第二列。
【问题讨论】:
标签: r dplyr duplicates concatenation identify