【发布时间】:2020-07-17 11:42:17
【问题描述】:
我正在尝试计算组内某个因素的不同水平的百分比。
我有嵌套数据,想查看每个国家/地区的学校百分比是私立学校(2 个级别的因素)。
但是,我不知道该怎么做。
# my data:
CNT <- c("A", "A", "A", "A", "A", "B", "B", "B", "C", "C", "C", "C", "C", "C", "D", "D",
"D", "D", "D", "D")
SCHOOL <- c(1:5, 1:3, 1:6, 1:6)
FACTOR <- as.factor(c(1,2,1,2,1,1,1,2,1,2,2,2,1,1,1,1,1,1,1,1))
mydata <- data.frame(CNT, SCHOOL, FACTOR)
head(mydata)
我想要一个列,其中包含每个国家/地区内一个因子级别(假设为 1)的百分比。
【问题讨论】:
-
我认为您也可以参考上一篇文章,以获得使用
dplyrRelative frequencies / proportions with dplyr 计算分组 df 中的相对频率的更一般的答案。 -
另一种方式:
mydata %>% count(CNT, FACTOR) %>% group_by(CNT) %>% mutate(n = n/sum(n))
标签: r dplyr aggregate data-wrangling