【发布时间】:2018-11-01 16:27:33
【问题描述】:
我有一个数据框 (allDat),如下所示(但更多行),我正在尝试对其进行子集化以获取表达式底部 10% 的个人(样本):
SampleID Expression Gene
HSB496 14.64295 ENSG00000118271
HSB261 14.3346 ENSG00000144820
HSB248 13.48286 ENSG00000167552
这是我尝试过的方法,但我觉得这是错误的,或者至少可能有更好的方法:
allDat_10 <- subset(allDat, Expression > quantile(Expression, prob = 10/100, na.rm = TRUE))
【问题讨论】:
-
您可能想要
expr < quantile(...),否则您将获得前 90%。检查dim(allDat_10)以确保您获得正确的行数。