【发布时间】:2018-07-27 05:26:50
【问题描述】:
必须修改原始帖子以包含更好的示例
我有一个基于时间的数据的小标题,其中包含开始时间、结束时间和以下一般形式的类变量:
制作表格的代码:
library(lubridate)
st <- c(ymd_hms("2016-01-01 00:35:00"),
ymd_hms("2016-01-01 00:39:00"),
ymd_hms("2016-01-01 00:54:00"),
ymd_hms("2016-01-01 00:56:00"),
ymd_hms("2016-01-01 00:57:00"))
en <- c(ymd_hms("2016-01-01 00:36:00"),
ymd_hms("2016-01-01 00:45:00"),
ymd_hms("2016-01-01 00:55:00"),
ymd_hms("2016-01-01 00:57:00"),
ymd_hms("2016-01-01 00:58:00"))
cl <- c("a","a","a","b","b")
df <- tibble(st,en,cl)
周期不一致,数据中存在隐藏类:本质上,数据中未明确列出的时间在本例中属于第三类。
我需要一种方法来将此表扩展为具有固定周期(1 分钟),以便我可以将缺失的类分配给这些周期;目标是:
我确信这可以使用 dplyr 和 lubridate 来完成,但一直无法完成。请记住,我的数据集非常庞大,因此最好采用非循环方法。
提前致谢,
先生
【问题讨论】:
标签: r dplyr timestamp lubridate