【问题标题】:count the number of occurrences for each variable using dplyr使用 dplyr 计算每个变量的出现次数
【发布时间】:2020-04-25 18:51:12
【问题描述】:

这是我的数据框(tibble)df:

   ENSG00000000003 ENSG00000000005 ENSG00000000419 ENSG00000000457 ENSG00000000460
             <dbl>           <dbl>           <dbl>           <dbl>           <dbl>
 1              61               0              70               0               0
 2               0               0             127               0               0
 3             318               0               2               0               0
 4               1               0               0               0               0
 5               1               0              67               0               0
 6               0               0               0             139               0
 7               0               0               0               0               0
 8             113               0               0               0               0
 9               0               0               1               0               0
10               0               0               0               1               0

对于每一列/变量,我想计算值大于 10 的行数。在这种情况下,第 1 列将为 3,第 2 列为零,等等。这是一个测试数据框,并且我想为许多专栏这样做。

【问题讨论】:

    标签: r dataframe dplyr count


    【解决方案1】:

    我们可以在逻辑矩阵上使用colSums

    colSums(df > 10, na.rm = TRUE)
    

    或使用dplyr

    library(dplyr)
    df %>%
       summarise_all(~ sum(. > 10, na.rm = TRUE))
    

    【讨论】:

    • 谢谢阿克伦。我更喜欢 dplyr 解决方案。?有人告诉我,我最好学习 dplyr 方式。
    【解决方案2】:

    我认为

    library(dplyr)
    df %>% summarise_all(~sum(.>10))
    

    会做你想做的。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2022-07-29
      • 1970-01-01
      • 2023-03-29
      • 2022-01-18
      • 2021-01-14
      相关资源
      最近更新 更多