【发布时间】:2014-02-07 14:17:26
【问题描述】:
很难解释我到底想用我的脚本实现什么,但让我试试吧。
我有 20 个不同的 csv 文件,所以我将它们加载到 R 中:
tbl = list.files(pattern="*.csv")
list_of_data = lapply(tbl, read.csv)
然后在您的帮助下,我将它们合二为一并删除了所有重复项:
data_rd <- subset(transform(all_data, X = sub("\\..*", "", X)),
!duplicated(X))
我现在有 1 个主表,其中包含所有名称(加入):
Accession
AT1G19570
AT5G38480
AT1G07370
AT4G23670
AT5G10450
AT4G09000
AT1G22300
AT1G16080
AT1G78300
AT2G29570
现在我想在其他 csv 文件中找到这个加入,并将这个加入的数据放在同一个原始文件中。有 20 个 csv 文件,每个 csv 有 20 列,所以在相同的情况下,它可能会给我 400 列。需要多长时间都没关系。它必须完成。甚至可以用 R 做吗?
例子:
First csv Second csv Third csv
Accession Size Lenght Weight Size Lenght Weight Size Lenght Weight
AT1G19570 12 23 43 22 77 666 656 565 33
AT5G38480
AT1G07370 33 22 33 34 22
AT4G23670
AT5G10450
AT4G09000 12 45 32
AT1G22300
AT1G16080
AT1G78300 44 22 222
AT2G29570
这似乎是一项艰巨的任务。可能它必须由循环完成。有什么想法吗?
【问题讨论】: