【问题标题】:How to define function to categorize value in new column using pandas data frame?如何定义函数以使用熊猫数据框对新列中的值进行分类?
【发布时间】:2019-11-25 18:52:24
【问题描述】:

例如,我有一个数据框,其中包含“日期时间”作为索引,列“a”作为变量。我想获取每一行的信息,它们属于哪个分位数,例如,我想仅在特定日期使用如下所示的 4 个级别的类别。

所以在“类别”列中,它将显示第 1 行属于 2019-05-02 数据的第一类。

datetime                a      category
2019-05-02 12:00       10         1
2019-05-02 13:00       10         1
2019-05-02 14:00       15         2
2019-05-02 15:00       20         4
2019-05-02 16:00       10         1
2019-05-02 17:00       15         3
2019-05-03 18:00       ...       

请不要介意计算。如何定义创建新列的函数?谢谢!

【问题讨论】:

    标签: python pandas csv


    【解决方案1】:

    如何找到:

    data['category'] = data.groupby(pd.Grouper(freq='D'))['a'].transform(
                     lambda x: pd.qcut(x, 4, labels=range(1,5)))
    

    来源: Pandas groupby and qcut

    【讨论】:

      猜你喜欢
      • 2020-06-22
      • 1970-01-01
      • 2021-12-22
      • 1970-01-01
      • 2014-04-23
      • 1970-01-01
      • 2017-10-15
      • 2020-09-03
      • 1970-01-01
      相关资源
      最近更新 更多