【问题标题】:R: how to create a ranking variable for each subject excluding NA valuesR:如何为每个主题创建一个排名变量,不包括 NA 值
【发布时间】:2020-06-21 18:49:31
【问题描述】:

我想做这样的情节:

我有“注视持续时间”(以秒为单位,但没关系)和“时间”变量,我需要创建“固定注视序数”变量,其中注视将根据时间变量为每个主题进行排名强>。 My Fixation 数据包含一些 NA 值,不应包含在排名中。

摘自我的数据:

Subject FixationDuration Time
1       NA               1
1       0.33             2
1       NA               3
1       0.15             4.22
1       3.20             5.93
..
2       6.88             1
2       9.23             3
2       0.77             3.01
2       1.88             4.91
..
15      6.22             1
15      NA               1.56
15      NA               1.76
15      0.24             2.39

我需要以下结果:

Subject FixationDuration Time  OrdinalFixationNumber
1       NA               1     NA
1       0.33             2     1
1       NA               3     NA
1       0.15             4.22  2
1       3.20             5.93  3
..
2       6.88             1     1
2       9.23             3     2
2       0.77             3.01  3
2       1.88             4.91  4
..
15      6.22             1     1
15      NA               1.56  NA
15      NA               1.76  NA
15      0.24             2.39  2

谁能帮我解决这个问题?谢谢。

【问题讨论】:

  • 很抱歉,它对我不起作用,我认为问题没有正确表述,所以我再次尝试了更详细的表述。
  • 因为您之前的问题大于 0,而现在是 NA

标签: r dplyr tidyverse


【解决方案1】:

这是一种选择。按'Subject'分组后,replace'FixationDuration' 中的非 Na 元素按 row_number 排序,其中'FixationDuration' 为非NA 的'Time' 值

library(dplyr)
df1 %>% 
   group_by(Subject) %>% 
   mutate(OrdinalFixationNumber = replace(FixationDuration,
      !is.na(FixationDuration), row_number(Time[!is.na(FixationDuration)])))
# A tibble: 13 x 4
# Groups:   Subject [3]
#   Subject FixationDuration  Time OrdinalFixationNumber
#     <int>            <dbl> <dbl>                 <dbl>
# 1       1            NA     1                       NA
# 2       1             0.33  2                        1
# 3       1            NA     3                       NA
# 4       1             0.15  4.22                     2
# 5       1             3.2   5.93                     3
# 6       2             6.88  1                        1
# 7       2             9.23  3                        2
# 8       2             0.77  3.01                     3
# 9       2             1.88  4.91                     4
#10      15             6.22  1                        1
#11      15            NA     1.56                    NA
#12      15            NA     1.76                    NA
#13      15             0.24  2.39                     2

data.table 中,可以使用

library(data.table)
setDT(df1)[!is.na(FixationDuration), OrdinalFixationNumber := 
          seq_len(.N)[order(Time)], by = Subject]
df1
#    Subject FixationDuration Time OrdinalFixationNumber
# 1:       1               NA 1.00                    NA
# 2:       1             0.33 2.00                     1
# 3:       1               NA 3.00                    NA
# 4:       1             0.15 4.22                     2
# 5:       1             3.20 5.93                     3
# 6:       2             6.88 1.00                     1
# 7:       2             9.23 3.00                     2
# 8:       2             0.77 3.01                     3
# 9:       2             1.88 4.91                     4
#10:      15             6.22 1.00                     1
#11:      15               NA 1.56                    NA
#12:      15               NA 1.76                    NA
#13:      15             0.24 2.39                     2

数据

df1 <- structure(list(Subject = c(1L, 1L, 1L, 1L, 1L, 2L, 2L, 2L, 2L, 
15L, 15L, 15L, 15L), FixationDuration = c(NA, 0.33, NA, 0.15, 
3.2, 6.88, 9.23, 0.77, 1.88, 6.22, NA, NA, 0.24), Time = c(1, 
2, 3, 4.22, 5.93, 1, 3, 3.01, 4.91, 1, 1.56, 1.76, 2.39)), 
class = "data.frame", row.names = c(NA, 
-13L))

【讨论】:

    猜你喜欢
    • 2021-07-05
    • 2017-03-22
    • 1970-01-01
    • 2014-12-14
    • 2017-05-24
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多