【发布时间】:2016-09-11 15:23:48
【问题描述】:
我有一个数据框。我们就叫他dean_data
dean_data<-data.frame(date=c("23/06/2010", "23/06/2010", "23/06/2010", "29/07/2010", "29/07/2010", "29/07/2010"),
hb=c(60, 55, 50, 80, 60, 70),
pe=c(11.5, 11.2, 11.7, 8.5, 8, 8.25),
v.d=c(2.17, 2.65, 3.66, 2.78, 2.71, 2.68))
首先,我想计算参数“n”次的均值和标准差,按日期(因子)改变线条的位置。
只有在我做数据子集之前,我才能这样做,像这样:
jun13<-subset(dean_data, date=="23/06/2010")
B = 1000
df<-matrix(NA,nrow=B)
for (b in (1:B)){
df[b]<-mean(sample(jun13$hb, replace=F)/(sample(jun13$pe, replace=F)*sample(jun13$v.d, replace=F)))
}
df
但是我有几个日期(n = 30)......我想学习以自动方式执行此操作,将数据子集分组并应用参数计算的重复。结果,我希望得到一个按日期显示平均值和 SD 的表格。
【问题讨论】:
-
我们的预期输出是什么?
-
因此您想按日期对数据进行分组。然后对每个组执行 1000 次操作。结果将是一个 data.frame,其中包含与唯一日期一样多的数千行。我猜对了吗?
-
是的!或按日期命名的列中并排的 1000 个结果,或按日期命名的平均值和 SD。随便。