【发布时间】:2020-03-17 14:03:18
【问题描述】:
我正在处理一个大型数据集。我在数据框中有变量例如调用。
Part<-c(1,2,3,4,5,6,7)
Disease_codes>- c(A100,A145,B165,B187,B102,C132,D156)
df<-data.frame(Part,Disease_codes)
实际上,我想将所有从“A”开始的疾病代码归类为“血癌”。从字母 A 开始的疾病代码(例如 A100、A145)是血癌。因为我需要将患有血癌的参与者排除在我的研究之外。当然,我不能手动执行此操作,因为我有大量参与者。那么,我怎样才能使具有以 A 开头的疾病代码的人的子集,然后将它们从我的数据框中排除。例如,我想要以下输出。
Blood_Cancer_Part<-c(1,2)
Part_without_Blood_cancer<-c(3,4,5,6,7)
【问题讨论】:
标签: r bioinformatics