【发布时间】:2020-06-23 21:17:03
【问题描述】:
我有一个非常大的数据集(50 多个站点,100 多个溶质),我想快速生成数据的描述性统计汇总表,并能够将其导出为 .csv 文件。
示例代码(我数据的一小部分):
Site <- c( "SC2", "SC2" , "SC2", "SC3" , "SC3" ,"SC3", "SC4", "SC4" ,"SC4","SC4","SC4")
Aluminum <- as.numeric(c(0.0565, 0.0668 ,0.0785,0.0292,0.0576,0.075,0.029,0.088,0.076,0.007,0.107))
Antimony <- as.numeric(c(0.0000578, 0.0000698, 0.0000215,0.000025,0.0000389,0.0000785,0.0000954,0.00005447,0.00007843,0.000025,0.0000124))
stats_data <- data.frame(Site, Aluminum, Antimony, stringsAsFactors=FALSE)
stats_data_gather =stats_data %>% gather(Solute, value, -Site)
table_test = stats_data_gather %>%
group_by(Site, Solute) %>%
get_summary_stats(value, show = c("mean", "sd", "min", "q1", "median", "q3", "max"))
这会产生一个计算所需统计信息的数据框,但是,结果会被截断到小数点后三位(即应该像 0.00000057 这样的东西显示为 0.000)。
我已经尝试过使用的变体:
options(digits = XX),
format(DF, format = "e", digits = 2),
format.data.frame(table_test, digits = 8)
我已经尝试了这些和其他在线找到的示例代码,但没有一个会重现包含所有必要零的摘要数据框,用于小数结果(即 0.00000057,而不是 0.000)。我什至可以使用科学记数法,但我没有成功找到一个可行的例子。
这是我的第一篇文章。我希望我已经提供了足够的细节来提供帮助! 谢谢!
【问题讨论】:
标签: r statistics scientific-notation leading-zero significant-digits