【发布时间】:2021-06-17 01:16:01
【问题描述】:
我有一个大型数据集,结构如下
dat <- data.frame("Date" = c("2017-01-01", "2017-01-20", "2017-04-15", "2017-11-03", "2018-01-03", "2019-12-12", "2020-03-07", "2014-05-19", "2009-07-03", "2010-02-04"),
"Region" = c("Adelaide", "Albany", "Albany", "Albany", "Albany", "Albany", "Albany", "Middleton", "Alice Springs", "Alice Springs"))
dat$Date <- as.Date(dat$Date, "%Y-%m-%d")
对于每条记录,如果它们在过去 12 个月内并且仅当它们在同一区域内时,我想计算它们的数量。任何帮助实现这一点将不胜感激?
我的最终数据集应该看起来与原始数据集相同,但添加了以下计数列
dat$Count <- c(0, 0, 1, 2, 3, 0, 1, 0, 0, 1)
此计数列显示,对于数据集中的第一条记录,在过去 12 个月中没有来自同一地区的其他记录,但是对于数据集中的第 5 条记录,在过去 12 个月中出现的其他记录有 3 条同一地区的月份。
我在dplyr 中使用group_by()、count() 和summarise() 尝试了一系列解决方案,但还没有达到我的意图。
【问题讨论】:
标签: r