【发布时间】:2019-04-23 21:08:38
【问题描述】:
我有一个这样的字符串集
genome
A DNAStringSet instance of length x
width seq
[1] 1003 GAACAGCATGAATGTTAAAACTGA...AGGTTTTCAGAAAAAGCAGAAGA
[2] 150 TATATATATATAGTCAATTCGAGG...CTATTCCAGAGTTTCCTTGCAAA
[3] 1619 ATAGACATACACACAAATATTTTT...TATTTATACATATATATATATAT
[4] 359 TCACCAGTGGCAGCCGCGGCTACA...GTACAACGACCCTGATGACTCCG
我只会选择大于 tresh = 1000 的字符串 我试过了
genome[filter(width(genome) >=1000]
但是这并没有给出正确的解决方案。 我会期待这样的输出:
genome
A DNAStringSet instance of length x
width seq
[1] 1003 GAACAGCATGAATGTTAAAACTGA...AGGTTTTCAGAAAAAGCAGAAGA
[3] 1619 ATAGACATACACACAAATATTTTT...TATTTATACATATATATATATAT
任何人都可以向我推荐一个工作脚本吗?
【问题讨论】:
-
你能给我们一个
dput的数据吗?或dput(head(data))。无论如何,我认为你可以做genome[ genome$width >= 1000]。 -
这个解决方案不起作用,因为我使用了 DNAstringset