【发布时间】:2021-11-08 21:30:15
【问题描述】:
我有一个包含 83 个 csv 文件的列表,其中包含三个变量。
我创建了新的日期列,包括月份和年份。
列表中的一个数据框如下所示:
> head(estaciones$AeropuertodeBocas_93002)
Date Tx2m Tn2m Pr year month day
1 1988-01-01 27.4 23.1 41.3 1988 1 1
2 1988-01-02 29.8 24.0 0.3 1988 1 2
3 1988-01-03 30.4 24.0 0.4 1988 1 3
4 1988-01-04 30.0 24.2 2.4 1988 1 4
5 1988-01-05 29.6 23.2 9.1 1988 1 5
6 1988-01-06 30.0 23.1 5.2 1988 1 6
我想创建一个新文件,其中包含每个变量以及每月和每年的 NA 值百分比。例如 1988 年 6 月:变量“Pr”和数据框“x”的缺失值占 2%。
我尝试过使用:
na_by_month <- map(estaciones, ~ .x %>%
mutate(Month=month(Date), Mis = rowSums(is.na(.))) %>%
group_by(Month) %>%
summarise(Sum=sum(Mis), Percentage=mean(Mis)))
这只是计算整个系列的每个月的缺失值百分比,而不是每年。
数据(几个 dfs 之一):
df <- structure(list(Date = structure(c(6574,
6575, 6576, 6577, 6578, 6579), class = "Date"),
Tx2m = c(27.4, 29.8, 30.4, 30, 29.6, 30),
Tn2m = c(23.1, 24, 24, 24.2, 23.2, 23.1),
Pr = c(41.3, 0.3, 0.4, 2.4, 9.1, 5.2),
year = c(1988, 1988, 1988, 1988, 1988, 1988 ),
month = c(1, 1, 1, 1, 1, 1), day = 1:6),
row.names = c(NA, 6L), class = "data.frame")
如何创建一个新文件,其中包含每个月和每年列表中每个数据框的缺失值百分比?谢谢你
【问题讨论】:
-
请提供数据:
dput(head(estaciones$AeropuertodeBocas_93002))