【问题标题】:R dplyr::summarize groups by user defined functionsR dplyr::summarize groups by user defined functions
【发布时间】:2020-08-17 15:33:01
【问题描述】:

我有一个包含三个变量(基因、样本、拷贝数)的 data.frame,我想对按基因名称分组的拷贝数进行汇总统计。

我尝试在 dplyr 中使用 summarise 函数,但一直失败。

我想要更多或更少特定 corrected_copy_number 的样本数

数据看起来像这样(截断)

> sub.melt.df.annotations.cna.genes
       Gene_Names          sample corrected_copy_number
3234        BRCA1 sample1                     6
7317        BRCA2 sample1                     1
10500       ERBB2 sample1                     4
11258       GATA3 sample1                     3
3234        GATA3 sample2                     2
7317        BRCA2 sample2                     1
10500       ERBB2 sample2                     3
.
.
11258       GeneX sampleN                     #



> sub.melt.df.annotations.cna.genes %>% group_by(Gene_Names) %>% dplyr::summarise(count=n(), min(corrected_copy_number),gain=n((corrected_copy_number>2)))
Error: Problem with `summarise()` input `gain`.
x unused argument ((corrected_copy_number > 2))
ℹ Input `gain` is `n((corrected_copy_number > 2))`.
ℹ The error occurred in group 1: Gene_Names = "BRCA1".
Run `rlang::last_error()` to see where the error occurred.

感谢您的帮助

【问题讨论】:

  • n 不接受其他参数,例如 (corrected_copy_number > 2)

标签: r dataframe dplyr summarize


【解决方案1】:

n(corrected_copy_number>2) 替换为sum(corrected_copy_number>2)

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2019-01-08
    • 2021-09-18
    • 1970-01-01
    • 1970-01-01
    • 2021-05-23
    • 2019-02-16
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多