【发布时间】:2019-03-03 08:57:45
【问题描述】:
我有一个看起来像这样的 df:
column1 column2 column3 column4
1 2 nan 4
1 2 3 nan
1 2 nan nan
1 2 nan nan
如何重塑数据框,为每个带有 NaN 的单元格删除它,如果该列具有相同的值,则只采用它的一个实例?
新的 df 应该是这样的;
column1 column2 column3 column4
1 2 3 4
我有大约 500 列这样的参差不齐的数据。
编辑:
我使用这行代码将带有参差不齐的数据的值移动到一行。
df = df.apply(lambda x: pd.Series(x.dropna().values))
新的 df 看起来像这样:
column1 column2 column3 column4
1 2 3 4
1 2 nan nan
1 2 nan nan
1 2 nan nan
然后我删除重复项:
df = df.drop_duplicates()
df 现在看起来像这样:
column1 column2 column3 column4
1 2 3 4
1 2 nan nan
不知道为什么 Nan 在这一点之后没有下降,但行正在下降:
pivoted_df = pivoted_df.dropna()
【问题讨论】:
标签: python python-3.x pandas nan