【发布时间】:2017-05-17 18:29:46
【问题描述】:
我有一个看起来像这样的 R 数据框
1 A 1
2 A 0.9
5 A 0.7
6 A 0.6
8 A 0.5
3 B 0.6
4 B 0.5
5 B 0.4
6 B 0.3
我需要填补所有空白,直到每个类别的最大值(第二列)。 即我希望得到的结果如下
1 A 1
2 A 0.9
3 A 0.9
4 A 0.9
5 A 0.7
6 A 0.6
7 A 0.6
8 A 0.5
1 B 0.6
2 B 0.6
3 B 0.6
4 B 0.5
5 B 0.4
6 B 0.3
基本上,当在第一个 obs 之前有缺失数据时向后填充,当缺失数据介于两者之间时向前填充。 我所做的是按猫分组
groupby = ddply(df, ~fit$group,summarise, max=max(time))
A 8
B 6
但现在我被困在接下来的步骤中。
【问题讨论】:
-
你可以使用
complete(df1, v1, v2)fromlibrary(tidyr) -
对不起,我编辑是因为我错过了有关填充的部分,但感谢您的回答
-
可能你提到的包的填充功能正是我要找的
标签: r dataframe data-manipulation