【发布时间】:2018-08-02 17:45:54
【问题描述】:
我正在使用以下数据框,其中包含 1997-2010 年每一年的列变量数据,以及由列“min”和“max”描述的年份范围。
如果年份在最小值到最大值的范围内,我希望将每一年列中的值更改为 1。我该怎么做?
library(tidyverse)
df <- structure(list(`1997` = c(1, 0, 0, 0, 0, 0), `1998` = c(0, 0,
0, 0, 0, 0), `1999` = c(0, 0, 0, 0, 0, 0), `2000` = c(0, 0, 0,
1, 0, 1), `2001` = c(0, 0, 0, 1, 0, 1), `2002` = c(0, 0, 0, 0,
0, 1), `2003` = c(0, 0, 0, 0, 0, 1), `2004` = c(0, 0, 0, 0, 0,
1), `2005` = c(0, 0, 0, 1, 0, 1), `2006` = c(0, 0, 1, 0, 0, 1
), `2007` = c(0, 0, 1, 1, 0, 1), `2008` = c(0, 0, 1, 1, 0, 1),
`2009` = c(0, 0, 1, 1, 0, 1), `2010` = c(0, 0, 1, 1, 0, 1
), min = c(1997, 1998, 2006, 2000, 1997, 2000), max = c(1998,
1998, 2010, 2010, 2008, 2010)), row.names = c(NA, -6L), class = c("tbl_df",
"tbl", "data.frame"), .Names = c("1997", "1998", "1999", "2000",
"2001", "2002", "2003", "2004", "2005", "2006", "2007", "2008",
"2009", "2010", "min", "max"))
我尝试使用 dplyr 包中的 mutate_at 并创建一个向量来分配给这些列(并稍后进行操作),但我在这个角度上苦苦挣扎。我应该如何将以下调用更改为funs(),以便我可以将该范围内的所有 0 更改为 1?
for (i in 1:nrow(df)){
if (!is.na(df[i,]$min) & !is.na(df[i,]$max)){
df[i,] <- df[i,] %>%
mutate_at(vars(`1997`:`2010`), funs(min:max))
}
}
【问题讨论】:
-
有趣的问题。我希望你不会介意最终的 data.frame 显示
TRUE/FALSE而不是1/0