【发布时间】:2013-10-30 23:53:33
【问题描述】:
我正在以标准方式重新索引数据框,即
df.reindex(newIndex,method='ffill')
但我意识到我需要逐列以不同方式处理缺失数据。也就是说,对于某些列,我想填充,但对于其他列,我想丢失记录为 NA 的值。
为简单起见,假设我有想要填充的 X 列和想要 NA 填充的 Y 列。如何调用 .reindex 来完成此操作?
【问题讨论】:
-
不能调用两次吗?使用
columns=[Y]参数和columns=[X]参数? -
@jaor 所以你的意思是做两个单独的索引,然后合并两个结果数据帧?
-
我猜。参数
columns仅影响指定的列。都在这里我猜pandas.pydata.org/pandas-docs/stable/generated/… -
reindex,然后根据需要在各个列上添加fillna