【发布时间】:2017-10-05 19:48:38
【问题描述】:
我有一个这样的多索引数据框:
import pandas as pd
import numpy as np
df = pd.DataFrame({'ind1': list('aaaaaaaaabbbbbbbbb'),
'ind2': list('cccdddeeecccdddeee'),
'ind3': list(range(3))*6,
'val1': list(range(100, 118)),
'val2': list(range(70, 88))})
df_mult = df.set_index(['ind1', 'ind2', 'ind3'])
val1 val2
ind1 ind2 ind3
a c 0 100 70
1 101 71
2 102 72
d 0 103 73
1 104 74
2 105 75
e 0 106 76
1 107 77
2 108 78
b c 0 109 79
1 110 80
2 111 81
d 0 112 82
1 113 83
2 114 84
e 0 115 85
1 116 86
2 117 87
我要做的是分别从df_mult.loc['a', ['c', 'd'], :]和df_mult.loc['b', ['c', 'd'], :]对应的值中分别减去df_mult.loc['a', 'e', :]和df_mult.loc['b', 'e', :]中的值。预期的结果是
val1 val2
ind1 ind2 ind3
a c 0 -6 -6
1 -6 -6
2 -6 -6
d 0 -3 -5
1 -3 -5
2 -3 -5
e 0 106 76
1 107 77
2 108 78
b c 0 -6 -6
1 -6 -6
2 -6 -6
d 0 -3 -3
1 -3 -3
2 -3 -3
e 0 115 85
1 116 86
2 117 87
理想情况下,这样的事情会起作用
df_mult.loc['a', ['c', 'd'], :].subtract(df_mult.loc['a', 'e', :])
但这给了我很多NaNs。
我该怎么做?
【问题讨论】:
-
这是 Python-2.x 吗?
-
@WillemVanOnsem:是的。
标签: python pandas dataframe subtraction