【发布时间】:2016-11-29 09:34:48
【问题描述】:
我目前正在开展一个研究员工流动率的项目。到目前为止,我已经创建了一个类似于以下示例的表:
library(tidyverse)
Data <- data.frame(Month = c("Jan", "Feb", "March", "Jan", "Feb", "March"),
Location = c("Sheffield", "Sheffield", "Sheffield","London", "London", "London"),
Joiners = c(7,3,8,4,9,1),
Leavers = c(1,5,9,3,2,5)) %>%
mutate(Net_Change = Joiners - Leavers)
我想通过根据位置和月份(按顺序)获取 Net_Change 列的总和来计算团队规模。例如,伦敦 2 月的团队规模应为 8 (1+7),3 月的团队规模应为 4 (1+7-4)。
我曾尝试使用 dplyr 'summarise' 函数执行此操作,但没有成功。如果“tidyverse”方法适用,那就太好了。
非常感谢您在这方面的帮助!
【问题讨论】:
-
你好像在找
cumsum()。
标签: r dplyr calculated-columns