【发布时间】:2015-02-27 11:06:02
【问题描述】:
我参考了以下链接,似乎不适合我的问题。
Remove rows based on factor-levels
Remove row based on two factor levels
我有一个数据框,如下所示。
ZNF226 1 A
ZNF226 1 P
ZNF227 1 M
ZNF227 1 P
ZNF229 1 P
ZNF229 1 A
ZNF23 1 M
ZNF230 1 A
ZNF232 1 P
ZNF233 1 A
ZNF233 1 P
ZNF234 1 P
ZNF235 1 A
ZNF236 1 P
ZNF236 1 P
ZNF238 1 A
ZNF238 1 M
ZNF239 1 P
ZNF24 1 A
ZNF24 1 P
ZNF24 1 P
ZNF24 1 P
我想删除重复的行。我想在第三列中保留 P>A>M 偏好的行。如果 rows 具有 P,A,M 则仅保留具有 P 的行。如果 A 和 M 则 A 将在那里删除其他重复项,最后是 M。预期输出如下
ZNF226 1 P
ZNF227 1 P
ZNF229 1 P
ZNF23 1 M
ZNF230 1 A
ZNF232 1 P
ZNF233 1 P
ZNF234 1 P
ZNF235 1 A
ZNF236 1 P
ZNF238 1 A
ZNF239 1 P
ZNF24 1 P
行数约为 70k。提前致谢。
已编辑:第一行和第二行上方是重复项。第一行第三列有A,第二行第三列有P。正如我提到的,首选将是P>A>M。所以 A 在 P 之后有第二个偏好。所以用A 删除行。
现在在第 3 和第 4 行。 P 优先保留,所以使用M 删除行
【问题讨论】:
标签: r