【发布时间】:2016-05-11 17:10:21
【问题描述】:
我有一个大的 data.frame,我想通过另一个分类变量的分组来聚合它。一种方法是:
cars = mtcars
carb_grps = data.frame(carb = 1:8, carb_grp = rep(c('Low','Mid','High'), c(2,2,4)))
cars = merge(cars, carb_grps, by = 'carb')
aggregate(mpg ~ carb_grp, cars, mean)
carb_grp mpg
1 High 17.35000
2 Low 23.61176
3 Mid 15.90769
但这会复制大型 data.table 中的所有 carb_grp 详细信息,我猜这会占用更多内存?我想知道 R 中是否有更优雅/更有效的方式来实现这一目标?
【问题讨论】:
标签: r