【发布时间】:2022-10-02 17:36:32
【问题描述】:
我正在寻找将数据框中的数据拆分并转移到包含 NaN 的列中
从 pdf 读取数据并创建表格后,输出为:
Output
| Summary | Prior Years|1|2|3|4| 5 |6|7|8|9|10| Total |
|---------------------|-------------|-|-|-|-|---|-|-|-|-|--|---------|
|Total Value 3,700,000| 110 |-|-|-|5|NaN|-|-|-|-|--|3,815,000|
|Total Value 320,000 | 110 |-|-|-|5|NaN|-|-|-|-|--| 435,000 |
由于 PDF 格式,读取数据会导致第一列将“总价值”和“前几年”的预期值结合起来
Expected Output
| Summary |Prior Years| 1 |2|3|4|5|6|7|8|9|10| Total |
|-----------|-----------|---|-|-|-|-|-|-|-|-|--|---------|
|Total Value| 3,700,000 |110|-|-|-|5|-|-|-|-|--|3,815,000|
|Total Value| 320,000 |110|-|-|-|5|-|-|-|-|--| 435,000 |
包含 NaN 的 \'5\' 列之后的所有数据都符合预期
有没有办法拆分 \'Summary\' 列中的数据并让所有数据转移,直到 NaN 列被占用?
-
是否需要多次或只为该列执行一次该操作数?
-
目前,看起来完整的数据集只需要这样做一次
-
@DominickR,发布了一个解决方案,它有帮助吗?
标签: python pandas dataframe split