【问题标题】:gtsummary::tbl_summary and unique variable valuesgtsummary::tbl_summary 和唯一变量值
【发布时间】:2023-02-14 12:51:51
【问题描述】:

我正在尝试使用 gtsummary::tbl_summary 创建一个表,该表允许我在变量中使用不同的值。我有一个数据框,其中每一行代表一次患者就诊,这意味着一个 ID 可以多次出现。我不想在表中列出每个 ID 计数,而是想要计算唯一 ID 的总和。尝试坚持使用 gtsummary,因为它提供了格式良好的值

library(gtsummary)

df <- data.frame(id   = c("a", "b", "c", "a", "a", "c", "b"))
tbl_summary(df)

Current output

Desired output

【问题讨论】:

    标签: r gtsummary


    【解决方案1】:

    根据需要,我们可以从 'id' 得到 n_distinct

    library(gtsummary)
    library(dplyr)
    library(tidyr)
    df %>% 
      summarise(Number_of_Patients = n_distinct(id)) %>%
      uncount(Number_of_Patients, .remove = FALSE) %>%
      tbl_summary()
    

    -输出

    【讨论】:

      【解决方案2】:

      如何在其他变量表中添加这一列 distinct?

      我希望干预组显示唯一的 host_study_id 的数量,构建到我下面的内容中;

          tbldf = df %>% select("intervention", "host_study_id")
          tbl_summary(tbldf, by = "intervention") %>% modify_caption("Study 
          population")
      

      【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 2021-01-10
      • 2020-06-23
      • 1970-01-01
      • 2021-07-28
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多