【发布时间】:2020-07-26 17:20:53
【问题描述】:
假设我有这个数据集(不是我使用的原始数据)
data <- data.frame(
name=c( rep("A",500), rep("B",500), rep("B",500), rep("C",20), rep('D', 100) ),
value=c( rnorm(500, 10, 5), rnorm(500, 13, 1), rnorm(500, 18, 1), rnorm(20, 25, 4), rnorm(100, 12, 1) )
)
我希望我的代码
- 组名称
- 值降序排列
- 并选择前 30%,但不是按我的 value 变量的值,而是每个 name 的行数
我的代码是这样开始的:
data <- data %>%
arrange(name, value) %>%
我阅读了 top_frac() 但据我了解,它选择了前 x% 的值。
提前致谢!
【问题讨论】: