【发布时间】:2021-11-02 00:52:03
【问题描述】:
我有一个看起来像这样的代码
Month| Day| Year| Color| Weather|Location|Transporation|ID
Jan Tue 2020 Blue Warm Hospital NA 1
Jan Tue 2020 Blue Warm NA NA 1
Jan Tue 2020 Blue NA NA NA 1
Feb Thu 2020 Red NA NA NA 2
Feb Thu 2020 Red Warm NA NA 2
Feb Thu 2020 Red Warm Garden Run 2
Mar Thu 2020 Red Cold Desk Bus 3
我希望它看起来像这样
Month| Day| Year| Color| Weather|Location| Transporation|ID
Jan Tue 2020 Blue Warm Hospital NA 1
Feb Thu 2020 Red Warm Garden Run 2
Mar Thu 2020 Red Cold Desk Bus 3
基本上我想通过选择三个c(ID,Month,Color) 来确定一列是否重复。一旦确定了重复项,我希望它删除具有最多 NA 或“完成最少”的那个,因为填充的列较少。
【问题讨论】:
标签: r dplyr duplicates