【发布时间】:2020-11-04 09:36:20
【问题描述】:
我是初学者,希望
- 为我的数据中的每个代码生成 adjboxStats()(见下文)
- 消除每个代码的异常值
一些虚拟数据:
code=c("A1","A2","A3","A1","A2","A3","A1","A2","A3","A1","A2","A3","A1","A2","A3","A1","A2","A3","A2","A3","A1","A2","A3","A1","A2"),
duration=c(100,100,100,200,200,200,23523,213123,12,23213,968,37253,573012,472662,3846516,233,262,5737,3038,2,5,123,969,6,40582)
)
目前,我能够在所有代码中生成结果,见下文。但是我有问题 i) 为每个代码运行统计信息(group_by(code) 会起作用吗?)然后 ii) 为每个代码排除发现的异常值 ($out)。
library(robustbase)
adjboxStats(data$duration, coef = 1.5, a = -4, b = 3, do.conf = TRUE, do.out = TRUE)
$stats
[1] 2 100 262 23523 573012
$n
[1] 50
$conf
[1] -4971.77 5495.77
$fence
[1] -571.2153 707257.8400
$out
[1] 3846516 3846516
非常感谢您的帮助!
【问题讨论】:
标签: r group-by mean boxplot outliers