【发布时间】:2020-06-29 10:48:38
【问题描述】:
我有一个具有重复 ID 的数据集,我正在尝试对数据进行排序,以便重复行彼此相邻,理想情况下,整个数据集也按 ID 值从小到大排序。
例如我的数据如下:
Gene ID
Gene1 1:1001
Gene1 5:20000
Gene2 5:20000
Gene3 1:1001
Gene4 10:4000
通过对重复项进行分组排序的预期输出,然后也保持理想的最小到最大 id 顺序:
Gene ID
Gene1 1:1001
Gene3 1:1001
Gene1 5:20000
Gene2 5:20000
Gene4 10:4000
我一直在尝试这样做:
dfordered <- df[order[duplicated(df$ID)]]
Error: object of type 'closure' is not subsettable
输入数据示例:
structure(list(Gene = c("Gene1", "Gene1", "Gene2", "Gene3", "Gene4"
), ID = c(" 1:1001, "5:20000", "5:20000", " 1:1001",
"10:4000")), row.names = c(NA, -5L), class = c("data.table",
"data.frame"))
【问题讨论】:
-
可重现的输入数据与打印的输入数据不匹配。
标签: r dataframe duplicates data.table