【发布时间】:2021-06-09 23:52:57
【问题描述】:
参加这个多索引系列:
client_id y-m
0 2018-05 13.935563
2018-06 5326.898967
2018-07 11968.431680
2018-08 NaN
2018-09 NaN
2018-10 15257.418813
2018-11 NaN
2018-12 20509.774900
2019-01 25187.485960
2019-02 NaN
2019-03 NaN
2019-04 NaN
2019-05 NaN
2019-06 NaN
2019-07 NaN
2019-08 35943.419296
2019-09 38253.756910
2019-10 42289.134021
2019-11 NaN
2019-12 NaN
2020-01 NaN
2020-02 NaN
2020-03 NaN
2020-11 NaN
2020-12 NaN
2021-01 NaN
1 2019-07 169.805400
2019-08 169.805400
2019-09 169.805400
2019-10 169.805400
2019-11 169.805400
2019-12 NaN
2020-01 NaN
2020-07 NaN
2020-08 NaN
2021-01 NaN
我想用 NaN 替换考虑到第一个索引 client_id 的重复值,保持第一个值。重要的是仅替换第一级索引的重复项。
对于上面的示例数据,client_id == 1 的重复值序列应仅保留 2019-07 的值,其他应设置为 NaN,如下所示:
1 2019-07 169.805400
1 2019-08 NaN
1 2019-09 NaN
1 2019-10 NaN
【问题讨论】:
标签: python pandas nan series multi-index