【问题标题】:Splitting a sequence within dataframe?在数据框中拆分序列?
【发布时间】:2014-07-31 08:29:46
【问题描述】:

我有一个这样的 csv 文件,

x <- read.csv("C:/Users/XXXX/Documents/XXXX/Day1_15042014/work2.csv")
class(x)
x$Sequence.window![enter image description here][1]

> x$Sequence.window

  [1] VVELRKTGGDTLEFHKFYKNFSSGLKDVVWN                                                                
  [2] PGLTTQGTKFGRKIVKTLAYRVKSTQPSSGN                                                                
  [3] EATEFYLRYYVGHKGKFGHEFLEFEFREDGK                                                                
  [4] LVPVVWGERKTPEIEKKGFGASSKAATSLPS                                                                
  [5] NMNELPEKKNSAGFIKLEDKQKLIVEMEKSV                                                                
  [6] PTLHFNYRYFETDAPKDVPGAPRQWWFGGGT                                                                
  [7] PDPTTAPMEAAKQPKKKRSRSKKCKSVNNLD                                                                
  [8] PAKAAKTAKVTSPAKKAVAATKKVATVATKK                                                     

这个类是一个数据框。我现在想在 10:22 范围内拆分序列窗口(Ex [1] VVELRKTGGDTLEFHKFYKNFSSGLKDVVWN,所有序列的输出应该类似于 [1] DTLEFHKFYKNFS)。我将如何在数据框中执行此操作?

【问题讨论】:

  • R 控制台上的参考类型?substr

标签: r csv split dataframe


【解决方案1】:

你可以使用substr函数

#dummy data
x <- read.table(text="Sequence.window
VVELRKTGGDTLEFHKFYKNFSSGLKDVVWN
PGLTTQGTKFGRKIVKTLAYRVKSTQPSSGN
EATEFYLRYYVGHKGKFGHEFLEFEFREDGK",header=TRUE,as.is=TRUE)

#substr from 10 to 22
substr(x$Sequence.window,start=10,stop=22)
#[1] "DTLEFHKFYKNFS" "FGRKIVKTLAYRV" "YVGHKGKFGHEFL"

【讨论】:

  • 没问题,不想为这个简单的问题重复另一个答案。
  • 感谢@zx8754,阅读手册并以相同的方式实现:)
猜你喜欢
  • 2018-03-03
  • 2017-05-09
  • 1970-01-01
  • 1970-01-01
  • 2020-12-21
  • 2019-11-12
  • 1970-01-01
  • 2015-08-28
  • 1970-01-01
相关资源
最近更新 更多