【发布时间】:2018-06-14 21:52:18
【问题描述】:
我想采用具有多索引和多列的 pandas 数据框。我想找到通过第三个多索引循环遍历列的最有效方法。我正在考虑取消堆叠,但我不知道如何通过该索引访问它们。有没有更好的方法(更快的处理方式):
df = pandas.DataFrame([{'Index_A':2018,'Index_B':0,'Index_C':101,'Col_D':0.3,'Col_E':.4},{'Index_A':2019,'Index_B':0,'Index_C':101,'Col_D':0.3,'Col_E':.4},{'Index_A':2019,'Index_B':0,'Index_C':102,'Col_D':0.3,'Col_E':.4}])
df = df.set_index(['Index_A','Index_B','Index_C'])
df = df.unstack()
for Index_C in [101,102]:
# get dataframe with index of ['Index_A','Index_B'] and columns ['Col_D,'Col_E']
【问题讨论】:
标签: python python-3.x pandas dataframe