【发布时间】:2018-05-05 17:36:38
【问题描述】:
计算带有因子的矩阵的汇总统计数据的最佳方法是什么(使用 R)?
样本数据:
df <- read.table(text="
Gender Obs1 Obs2 Obs3
1 F 0.0 -1.25 -1.23
2 M -0.5 0.83 -0.25
3 UNK 1.0 1.22 0.24
4 F 1.0 0.25 0.76
5 F 0.5 1.02 0.0
6 M 2.0 -0.05 0.66
7 M 1.0 5.80 NA
8 M 1.0 NA 1.0
9 UNK 0.0 NA 2.2", header=T)
df <- as.data.frame(df)
预期输出:
Gender | Obs1_count | Obs2_count | Obs3_count | Obs1_mean | Obs2_mean | Obs3_mean
---------------------------------------------------------------------------------
F 3 3 3 0.5 0.00667 -0.157
M 4 3 3 0.875 2.0433 0.47
UNK 2 1 2 0.5 1.22 1.22
我尝试过的:
library(dplyr)
summaryStats <- df %>% group_by(Gender) %>% na.omit() %>%
summarise_all(.funs = funs(
count = length(.),
mean = mean(.)))
【问题讨论】: