【问题标题】:tbl_summary and numeric variablestbl_summary 和数值变量
【发布时间】:2021-01-10 05:48:08
【问题描述】:

tbl_summary [library (gtsummary)] 不会以相同的方式处理所有数值变量,我不知道如何更改它。例如。

mtcars 只有数字变量,所以当我运行它时,我希望计算每个变量的平均值。相反,它将 cyl、gear 和 carb 视为分类。

tbl_summary(mtcars, statistic = list(all_numeric() ~ "{mean} ({sd})",
                                      all_categorical() ~ "{n} / {N} ({p}%)"))

我实际上有一个更大的数据集,并且 tbl_summary 将一些数值变量视为分类变量。会不会是因为 N 太少(假设我有很多缺失的行)而 tbl_summary 不想计算如此小的 N 的平均值?

我无法想象这个!

只是我数据中的另一个例子。 Q12_5_TEXT 是一个数值变量,但这是 tbl_summary 的输出。

【问题讨论】:

  • @Daniel D. Sjoberg 如果您有任何建议,请告诉我!

标签: r gtsummary


【解决方案1】:

我试过type = all_continuous() ~ "continuous2",我的版本是1.3.5,并没有改变摘要类型:

library(tidyverse)
library(gtsummary)

nrows <- 30

df <- tibble(
  a = sample(c(0,1,3.5,7.5),nrows,replace = T),
  b = sample(c("Group I","Group II"),nrows,replace = T)
)

df %>% 
  tbl_summary(
    by = b,
    type = all_continuous() ~ "continuous2",
    statistic = all_continuous() ~ "{mean} ({sd})"
  )

这个汇总变量“a”的输出就好像它是一个分类变量,尽管有类型参数。我也遇到了这个问题,这就是我来这里寻求答案的原因。如果我应该使用不同的论点,您可以指出我,我将不胜感激!

【讨论】:

  • 如果 1.3.5 还没有这个功能,你是否可以在即将到来的 1.3.6 更新中添加它?
  • 你需要type = a ~ "continuous2"。 ?
【解决方案2】:

对具有很少唯一级别的变量进行分类汇总。例如,mtcars$cyl 只有三个唯一级别:4、6、8。只有三个级别,分类摘要比平均值或中位数更合适。

使用type= 参数更改默认摘要类型。

【讨论】:

  • 如何更改此默认值? type = all_continuous() ~ "continuous2",不起作用
  • continuous2 的版本为 1.3.5 及更高版本。如果下载新版本不能解决您的问题,请发布一个reprex
猜你喜欢
  • 2023-02-14
  • 1970-01-01
  • 2021-07-27
  • 1970-01-01
  • 1970-01-01
  • 2021-04-22
  • 2020-06-23
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多