【发布时间】:2017-06-13 08:16:14
【问题描述】:
我有一个数据框列表。每个数据框最初都是取自其形状相同的数字数据,共有 21 行和 5 列。第一列是一个索引(索引 0 到索引 20)。我想将平均(平均值)值计算到单个数据帧中。然后我想将数据框导出到excel。
这是我现有代码的简化版本:
#look to concatenate the dataframes together all at once
#dataFrameList is the given list of dataFrames
concatenatedDataframes = pd.concat(dataFrameList, axis = 1)
#grouping the dataframes by the index, which is the same across all of the dataframes
groupedByIndex = concatenatedDataframes.groupby(level = 0)
#take the mean
meanDataFrame = groupedByIndex.mean()
# Create a Pandas Excel writer using openpyxl as the engine.
writer = pd.ExcelWriter(filepath, engine='openpyxl')
meanDataFrame.to_excel(writer)
但是,当我打开 excel 文件时,我看到每个数据框都被复制到工作表中,并且没有显示平均值/平均值。一个简化的例子如下所示(切割大部分行和数据框)
Dataframe 1 Dataframe 2 Dataframe 3
Index Col2 Col3 Col4 Col5 Col2 Col3 Col4 Col5 Col2 Col3 Col4 Col5
0 Data Data Data Data Data Data Data Data Data Data Data Data
1 Data Data Data Data Data Data Data Data Data Data Data Data
2 Data Data Data Data Data Data Data Data Data Data Data Data
....
我正在寻找类似的东西:
Averaged DF
Index Col2 Col3 Col4
0 Mean Index0,Col2 across DFs Mean Index0,Col3 across DFs Mean Index0,Col4 across DFs
1 Mean Index1,Col2 across DFs Mean Index1,Col3 across DFs Mean Index1,Col4 across DFs
2 Mean Index2,Col2 across DFs Mean Index2,Col3 across DFs Mean Index3,Col4 across DFs
...
我也已经看到了这个答案: Get the mean across multiple Pandas DataFrames
如果可能,我正在寻找一种干净的解决方案,而不是简单地涉及按值循环遍历每个 dataFrame 值的解决方案。有什么建议吗?
【问题讨论】:
标签: python pandas pandas-groupby