【问题标题】:GroupBy Count using Pandas Dataframe in python在 python 中使用 Pandas Dataframe 进行 GroupBy 计数
【发布时间】:2019-07-02 10:00:30
【问题描述】:

我知道如何做这个 Scala Spark - 我想知道为什么它在 Anaconda -Python 中如此痛苦

我想在 Python 中做同样的操作

val dfs = df.groupBy($"col1").count.orderBy(desc("count"))

这是报错

dfs = df[['col1']].groupby(['col1]).count.sort(['count'])

【问题讨论】:

    标签: python pandas scala apache-spark anaconda


    【解决方案1】:

    您可以使用.size().sort_values()

    试试这个:

    import pandas as pd
    import numpy as np
    
    df = pd.DataFrame.from_dict({"col1": np.random.randint(11, 20, size=100, dtype=int)})
    dfs = df.groupby('col1').size().sort_values()
    print(dfs)
    

    输出:

    col1
    16     7
    11     8
    15     8
    12     9
    14    11
    19    12
    13    13
    17    16
    18    16
    dtype: int64
    

    【讨论】:

      猜你喜欢
      • 2013-07-30
      • 2018-06-27
      • 2023-03-25
      • 2013-06-30
      • 1970-01-01
      • 1970-01-01
      • 2021-07-17
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多