【发布时间】:2019-06-18 19:34:47
【问题描述】:
想象一下这个数据框:
df <- tibble(
key = c(rep(1, 3), rep(2, 3), rep(3, 3)),
date = rep(Sys.Date(), 9),
hour = rep(c('00', '01', '02'), 3),
value = rep(c(8, 9, 10), 3)
)
我希望输出使得组摘要列是小时和值的命名列表。就好像我要为每个组执行此操作一样:
as.list(setNames(df$value[df$key == 1], df$hour[df$key == 1]))
$`00`
[1] 8
$`01`
[1] 9
$`02`
[1] 10
类似的东西,但确实有效的东西:
df %>%
group_by(key, date) %>%
summarise(
daily_value = sum(value),
hourly_values = as.list(setNames(value, hour))
)
也可以使用nest 或类似的 tidyr 解决方案。
编辑:输出应与此处生成的相同:
outputDf <- df %>%
group_by(key, date) %>%
summarise(daily_value = sum(value))
outputDf$hourly_value <- list(
as.list(setNames(df$value[df$key == 1], df$hour[df$key == 1])),
as.list(setNames(df$value[df$key == 2], df$hour[df$key == 2])),
as.list(setNames(df$value[df$key == 3], df$hour[df$key == 3]))
)
outputDf
# A tibble: 3 x 4
# Groups: key [?]
key date daily_value hourly_value
<dbl> <date> <dbl> <list>
1 1 2019-06-18 27 <list [3]>
2 2 2019-06-18 27 <list [3]>
3 3 2019-06-18 27 <list [3]>
outputDf$hourly_value
[[1]]
[[1]]$`00`
[1] 8
[[1]]$`01`
[1] 9
[[1]]$`02`
[1] 10
[[2]]
[[2]]$`00`
[1] 8
[[2]]$`01`
[1] 9
[[2]]$`02`
[1] 10
[[3]]
[[3]]$`00`
[1] 8
[[3]]$`01`
[1] 9
[[3]]$`02`
[1] 10
【问题讨论】:
-
如果您提供所需输出的示例,将会很有帮助。当您说“组摘要列是小时和值的命名列表”时,不确定您在寻找什么。
-
我不希望输出列的每个单元格都像
as.list(setNames(df$value[df$key == 1], df$hour[df$key == 1]))的输出那样。 -
您可以使用
purrr中的map()创建一个列表列,然后为列表列分配名称