【发布时间】:2016-07-26 18:56:53
【问题描述】:
我有一个包含多列的文件。我正在展示两列我感兴趣的两列
Probe.Set.ID Entrez.Gene
A01157cds_s_at 50682
A03913cds_s_at 29366
A04674cds_s_at 24860 /// 100909612
A07543cds_s_at 24867
A09811cds_s_at 25662
---- ----
A16585cds_s_at 25616
我需要用 "\t"(tab) 替换 /// 并且输出应该是这样的
A01157cds_s_at;50682
A03913cds_s_at;29366
A04674cds_s_at;24860 100909612
另外,我需要避免带有“---”的那些
【问题讨论】:
-
如果将
///替换为制表符,则某些行的列数会多于其他行,这将无法很好地导入。从外观上看,我会用read.fwf导入它并在事后修复它。 -
你正在苦苦挣扎的部分是什么?从外观上看,这可以读取为固定宽度数据
help(read.fwf),您已经找到了gsub用于替换分隔符,显然您可以使用write.csv2写入该数据。您需要帮助哪一部分?顺便说一句:fortune(230)
标签: regex r dataframe bioinformatics