【问题标题】:Remove duplicates from a column R [duplicate]从列 R 中删除重复项 [重复项]
【发布时间】:2015-09-30 03:18:34
【问题描述】:

我有一个很长的列(excel 中有 9500 行),其中有很多基因 ID。我想删除重复项。

ID
BXDC2                     
BXDC5                   
BXDC5                     
BZRPL1                    
BZRPL1                                       
C10orf11         
C10orf116                                 
C10orf119              
C10orf120    
C10orf125          
C10orf125       

我希望结果是:

ID
BXDC2                     
BXDC5                                      
BZRPL1                    
C10orf11         
C10orf116                                 
C10orf119              
C10orf120    
C10orf125         

谁能帮我写一个 R 脚本 :-)?

【问题讨论】:

  • 有点讽刺......删除重复项是重复项:)

标签: r duplicate-removal row-removal


【解决方案1】:

您可以使用duplicatedunique。在这里,我假设列名是'ID'

 df1[!duplicated(df1$ID),,drop=FALSE]

或者

  library(data.table)#v1.9.4+
  unique(setDT(df1), by='ID')

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2014-09-30
    • 1970-01-01
    • 1970-01-01
    • 2020-04-22
    • 1970-01-01
    • 1970-01-01
    • 2018-08-21
    • 2016-10-10
    相关资源
    最近更新 更多