【发布时间】:2017-12-16 15:33:10
【问题描述】:
我想使用summarise_each() 将多个函数应用于分组数据集。但是,我不想将每个函数应用于 all 列,而是将每个函数应用于特定的子集。我意识到我可以通过使用summarise() 指定每一列来做到这一点,但我有很多变量。
对于 1) 使用 summarise_each() 然后删除不需要的列或 2) 保存 group_by() 结果,执行多个单独的 summarise_each() 操作并合并结果,是否有替代解决方案?
如果不清楚,请告诉我,我可以尝试用一些示例代码来说明。
【问题讨论】:
-
我建议您使用示例数据、示例输出和您尝试/拥有的代码进行说明。
-
在这种情况下,遍历感兴趣的列并使用
lapply执行summarise或将Map与相应的感兴趣列的相应函数一起使用 -
关于您的问题“1) 使用 summarise_each() 然后删除不需要的列”您可以在
summarise_each中指定不应使用哪些列(但请注意,它们不会成为输出的一部分然后除非他们对列进行分组。 -
感谢 cmets。如果我理解正确的话,听起来
dplyr中没有内置的方法可以做到这一点。 @akrun,使用Map是什么意思?我找不到对此类函数或参数的任何引用。