【发布时间】:2018-05-11 02:35:21
【问题描述】:
我正在尝试将每列的百分位分布输出显示为数据框,因为我想稍后将其导出到 csv。
我只是像这样循环了所有列:
for column in data:
print(data[column].describe([.01,.1,.2,.3,.4,.5,.6,.7,.8,.9,.99]))
但是,我不知道如何休息。非常感谢任何帮助!
+用附加查询编辑主要问题:
我还想按data.groupby(data['MARKET']).describe([.01,.1,.2,.3,.4,.5,.6,.7,.8,.9,.99]) 之类的列对我的输出进行分组但是,我收到类似“describe() 采用 1 个位置参数但给出了 2 个”的错误。我该如何处理这个问题?
样本数据集:
d = {'col1': [1, 2, 3, 2, 1],
'col2': [3, 4, 5, 6, 7],
'country': ['TR', 'UK', 'UK' , 'TR', 'TR']};
df = pd.DataFrame(data=d)
【问题讨论】:
标签: python pandas loops dataframe percentile