【问题标题】:r - Dplyr 'ungroup' function in pandasr - Pandas 中的 Dplyr 'ungroup' 功能
【发布时间】:2018-09-05 23:12:28
【问题描述】:

想象一下你在 R 中有这个“dplyr”代码:

test <- data %>%
        group_by(PrimaryAccountReference) %>% 
        mutate(Counter_PrimaryAccountReference = n()) %>% 
        ungroup()

我怎样才能将它准确地转换为 pandas 等效代码? 不久,我需要分组以添加另一列,然后取消对初始查询的分组。我关心的是如何使用 pandas 包执行“取消分组”功能。

【问题讨论】:

    标签: python r pandas group-by dplyr


    【解决方案1】:

    这里的熊猫方式应该是使用transform函数:

    data['Counter_PrimaryAccountReference'] = data.groupby('PrimaryAccountReference')['PrimaryAccountReference'].transform('size')
    

    【讨论】:

    • 这绝不等同于 dplyr 代码。 dplyr 代码允许您从多个列分配多个值。
    【解决方案2】:

    现在您可以使用datar

    from datar import f
    from datar.dplyr import group_by, mutate, ungroup, n
    
    test = data >> \
           group_by(f.PrimaryAccountReference) >> \
           mutate(Counter_PrimaryAccountReference = n()) >> \
           ungroup()
    

    我是包的作者。如果您有任何问题,请随时提交问题。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 2018-06-13
      • 2019-01-23
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2013-12-06
      • 2021-10-22
      相关资源
      最近更新 更多