【问题标题】:Count Value Exclude Duplicated ID计数值排除重复 ID
【发布时间】:2022-11-01 18:31:26
【问题描述】:

我有数据框

df1 = pd.DataFrame({'id': ['1','2','2','3','3','4','5'],
                    'event': ['Basket','Soccer','Soccer','Basket','Soccer','Basket','Soccer']})

我想计算事件的唯一值,但排除重复的 id。我期望的结果是:

event   count   
Basket  3       
Soccer  3       

【问题讨论】:

    标签: pandas dataframe


    【解决方案1】:

    这将起作用:

    df1.groupby('event').agg({'id':lambda x: len(pd.unique(x))})
    
    # OR
    
    df1.groupby(['event']).agg(['nunique'])
    

    输出:

    【讨论】:

      【解决方案2】:

      您可以使用函数 drop_duplicates 删除数据框中的重复项:

       df1 = df1.drop_duplicates()
      

      然后,您只需按事件分组并使用计数聚合功能:

      df1 = df1.groupby("event").agg("count")
      

      【讨论】:

        猜你喜欢
        • 1970-01-01
        • 1970-01-01
        • 1970-01-01
        • 1970-01-01
        • 2022-11-01
        • 2016-05-24
        • 1970-01-01
        • 1970-01-01
        • 2018-05-16
        相关资源
        最近更新 更多