【发布时间】:2020-10-13 21:01:15
【问题描述】:
我正在尝试使用 RStudio 计算特定组的中位数。我使用 .csv 文件输入了我的数据,我的数据集 (MyData2) 如下所示:
score group
1 7 DiseaseX
2 14 DiseaseX
3 6 DiseaseX
4 6 DiseaseX
5 5 DiseaseX
6 5 DiseaseX
7 5 DiseaseX
8 14 DiseaseX
9 9 DiseaseY
10 5 DiseaseY
11 9 DiseaseY
12 7 DiseaseY
13 6 DiseaseY
14 5 DiseaseY
我将如何计算每个疾病 X 组和疾病 Y 组的平均“分数”?
我尝试使用 group_by 函数如下,但我一直收到错误。
MyData2 %>%
group_by(group) %>%
summarize(median = median(MyData2),
sum = sum(MyData2))
请注意,我是一名 RStudio 新手,正在尝试自学该程序的基础知识。
【问题讨论】:
-
而不是“中位数(MyData2)”,您引用整个数据框,您需要引用列,如“中位数(分数)”。
-
将
MyData2替换为您要从中计算中位数的变量的名称,所以我猜在您的示例中使用score
标签: r group-by dplyr median summary