【发布时间】:2021-08-12 19:04:21
【问题描述】:
我需要帮助在以下数据集中创建变量“NewVar”:
df2 <- read.table(
text =
"Year,Data,Country,NewVar,
1,3,US,NA,
3,NA,US,NA,
5,2,US,2,
7,7,US,NA,
10,NA,US,7,
1,3,UK,NA,
2,5,UK,NA,
3,4,UK,NA,
5,NA,UK,4,
10,6,UK,6,
", sep = ",", header = TRUE)
换句话说,一个变量,它根据年份和国家获取“数据”的第五个值。 如果该国家/地区在该特定时期内不存在任何值,则它将采用该国家在过去 5 年间隔内最接近的值。
提前谢谢你!
【问题讨论】:
-
您能多解释一下您希望输出的样子吗?顺便说一句,我从你的数据集中得到了一个额外的变量
X。 -
对于变量 X,我深表歉意。这是一个错字。输出变量 NewVar 将采用另一个变量的每五个值。换句话说,使名为 Data quinquennial 的列。但是由于数据有限,可能不存在每 5 年的数据,因此必须取该国家最近一年的值。最好是第 5 年,如果没有,最好是第 4 年,依此类推。
标签: r dataframe regression economics