【发布时间】:2021-10-28 18:47:41
【问题描述】:
我使用了 pandas 中的 groupby 方法,该方法可以在这个示例 csv 中按 id 和时间分组:
| id | month | average tree growth (cm)|
|----|-------|-------------------------|
| 1 | 4 | 9 |
| 1 | 5 | 4 |
| 1 | 6 | 7 |
| 2 | 1 | 9 |
| 2 | 2 | 9 |
| 2 | 3 | 8 |
| 2 | 4 | 6 |
但是,每个 id 应该有 12 个月,我需要将缺失月份的平均树高填写为空值,如下所示:
| id | month | average tree growth (cm)|
|----|-------|-------------------------|
| 1 | 1 | nan |
| 1 | 2 | nan |
| 1 | 3 | nan |
| 1 | 4 | 9 |
| 1 | 5 | 4 |
| 1 | 6 | 7 |
| 1 | 7 | nan |
| 1 | 8 | nan |
| 1 | 9 | nan |
| 1 | 10 | nan |
| 1 | 11 | nan |
| 1 | 12 | nan |
| 2 | 1 | 9 |
这是用于散景绘图的目的,在这种情况下,如何使用 python 将缺少的月份添加到每个 id 并将平均高度填充到 nan? 有没有比蛮力循环所有 id 并检查几个月更简单的方法? 任何提示将不胜感激!
【问题讨论】: