【发布时间】:2020-11-23 20:43:12
【问题描述】:
我是否可以使用 pandas pivot_table 对包含缺失值的列进行聚合,并将这些缺失值作为单独的类别包含在内?
In:
df = pd.DataFrame({'a': pd.Series(['X', 'X', 'Y', 'Y', 'N', 'N'], dtype='category'),
'b': pd.Series([None, None, 'd', 'd', 'd', 'd'], dtype='category')})
Out:
a b
0 X NaN
1 X NaN
2 Y d
3 Y d
4 N d
5 N d
In:
df.groupby('a')['b'].apply(lambda x: x.value_counts(dropna=False)).unstack(1)
Out:
NaN d
a
N NaN 2.0
X 2.0 0.0
Y NaN 2.0
我可以使用 pandas pivot_table 获得相同的结果吗?如果是,比怎么样?谢谢。
【问题讨论】:
标签: python pandas dataframe pivot-table nan