【发布时间】:2020-03-22 07:35:18
【问题描述】:
这个标题有点复杂,我敢肯定,如果我能想出一种更好地描述它的方法,我可以更好地用谷歌搜索它。
我的数据如下所示:
SET ID
100301006 1287025
100301006 1287026
100301010 1287027
100301013 1287030
100301011 1287027
并且我想识别并选择那些行中的每个值都具有该列的唯一值的行。在上面的示例中,我只想抓取行:
100301013 1287030
我不想要 SET100301006,因为它匹配 ID 字段中的 2 个不同记录(1287025 和 1287026)。同样,我不想要 SET 100301010,因为它与 (1287027) 匹配的 ID 记录也可以匹配另一个 SET (10030011)。
在某些情况下,匹配项可能超过 2 个。
我可以循环执行此操作,但这似乎是一种 hack。我想要一个基本的 R 或 data.table 解决方案,但我对 dplyr 不太感兴趣(试图最小化依赖关系)。
【问题讨论】:
标签: r dataframe data.table