【问题标题】:Repeated lines inside a column - python/pandas列内的重复行 - python/pandas
【发布时间】:2021-12-17 23:33:00
【问题描述】:

我最近开始使用 python 和 pandas 来读取 excel 文件。我有点卡住了一个我没有找到任何类似例子的问题。

假设我有来自不同机器不同分钟的数据。发生的情况是一台机器有多个信息。以下图为例,如果考虑机器 13.5,则有 5 个 5 分钟的关于成本和温度的信息。

我需要成本、温度和分钟信息的平均值,即每台机器只需要一行。再次以机器 13.5 为例,我只需要一个成本输出,即 34,4 (34+35+35+35+33/机器数量 13.5)。下面是我的代码。

         import pandas
         df = pandas.read_excel('Model.xlsx', engine='openpyxl')
         df 

【问题讨论】:

标签: python pandas dataframe compare rows


【解决方案1】:

您想使用groupby 选择要分组的列,然后调用mean()

所以你会这样做df.groupby(['M']).mean()

虽然简单的用法可以按单列分组,但您可以按多列分组或使用映射和函数来确定分组。您也不仅限于使用mean()。您可以在其他计算中使用sum()

这是文档中更详尽的指南:https://pandas.pydata.org/pandas-docs/stable/user_guide/groupby.html

【讨论】:

    猜你喜欢
    • 2013-11-19
    • 1970-01-01
    • 2018-04-10
    • 1970-01-01
    • 2013-02-05
    • 2013-06-22
    • 1970-01-01
    • 2017-03-07
    相关资源
    最近更新 更多