【发布时间】:2018-02-04 13:05:27
【问题描述】:
在过去的几周里,我一直在尝试构建回归输出的数据框,并且我已经完成了大部分工作。我现在正试图围绕列中的某些关键字对其进行重塑,据我所知,这些关键字是不可调用的。
我的数据框的简化版本如下所示:
? coef pval se rsq
Intercept 1 0 .1 .1
Cash 2 0.2 .05 .1
Food 2 0.05 .2 .1
Intercept 3 0 .1 .2
Cash 1 0.01 .2 .2
Food 2 0.3 .1 .2
Zone 1 0.4 .3 .2
我想要实现的是:
(1) (2)
Intercept coef 1 3
Intercept pval 0 0
Intercept se 0.1 0.1
Cash coef 2 1
Cash pval 0.2 0.01
Cash se 0.05 0.2
Food coef 2 2
Food pval 0.05 0.3
Food se 0.2 0.1
Zone coef NaN 1
Zone pval NaN 0.4
Zone se NaN 0.3
rsq 0.1 0.2
到目前为止,我已经尝试了几种方法,有希望使用 r-squared (rsq) 作为索引进行整形 -> RegTable = RegTable.pivot(index='rsq', columns=['pval', 'coef', 'robust_se'])
然而,这会返回错误ValueError: all arrays must be same length。一些研究让我认为这是因为截至目前,zone = NaN 由回归表示,根本没有区域行,但我不知道如何解决它。此外,我一直无法弄清楚如何调用我标识为“?”的列使用 PANDAS - 它没有在 CSV 输出中标记。此外,这种方法似乎存在问题,因为如果两个回归具有相同的 r 平方,它最终会抛出一个新的错误或平均每个值,这两者都不是完全可取的。
【问题讨论】:
标签: python pandas dataframe statsmodels