【发布时间】:2017-07-26 23:13:33
【问题描述】:
在熊猫 0.18.1、python 2.7.6 中:
假设我们有下表:
ID,FROM_YEAR,FROM_MONTH,AREA
1,2015,1,200
1,2015,2,200
1,2015,3,200
1,2015,4,200
1,2015,5,200
1,2015,6,200
1,2015,7,200
1,2015,8,200
1,2015,9,200
1,2015,10,200
1,2015,11,200
1,2015,12,200
1,2016,1,100
1,2016,2,100
1,2016,3,100
1,2016,4,100
1,2016,5,100
1,2016,6,100
1,2016,7,100
1,2016,8,100
1,2016,9,100
1,2016,10,100
1,2016,11,100
1,2016,12,100
我们正在尝试获取以下格式的日历年平均值
ID,FROM_YEAR,TYPE,AREA
1,2015,A,200
1,2016,A,100
1,2015,B,200
1,2016,B,100
注意:TYPE 是其他信息的字符串列。这里我们只有 2 种类型的 'TYPE':'A' 和 'B'
如果我们尝试以下操作,则缺少“AREA”列名,ID=1 也仅在第一种情况下显示。
AREA_CY=df.groupby(['ID','FROM_YEAR'])['AREA'].mean()
它返回:
ID,FROM_YEAR,
1,2015,200
,2016,100
,2015,200
,2016,100
如果我们尝试以下方法:
AREA_CY=df.groupby(['ID','FROM_YEAR'])['AREA'].mean(axis=1)
它返回:
TypeError: mean() got an unexpected keyword argument 'axis'
有哪位大师能开导吗?谢谢!
【问题讨论】:
标签: python-2.7 pandas mean