【问题标题】:GroupBy Count using Pandas Dataframe in python在 python 中使用 Pandas Dataframe 进行 GroupBy 计数
【发布时间】:2019-07-02 10:00:30
【问题描述】:
我知道如何做这个 Scala Spark - 我想知道为什么它在 Anaconda -Python 中如此痛苦
我想在 Python 中做同样的操作
val dfs = df.groupBy($"col1").count.orderBy(desc("count"))
这是报错
dfs = df[['col1']].groupby(['col1]).count.sort(['count'])
【问题讨论】:
标签:
python
pandas
scala
apache-spark
anaconda
【解决方案1】:
您可以使用.size() 和.sort_values()。
试试这个:
import pandas as pd
import numpy as np
df = pd.DataFrame.from_dict({"col1": np.random.randint(11, 20, size=100, dtype=int)})
dfs = df.groupby('col1').size().sort_values()
print(dfs)
输出:
col1
16 7
11 8
15 8
12 9
14 11
19 12
13 13
17 16
18 16
dtype: int64