【发布时间】:2015-09-23 04:47:50
【问题描述】:
我正在尝试计算数据框各列中每一行的唯一值的数量。
More context in my previous post and my answer
这是当前的数据框:
[in] df
[out]
PID CID PPID PPPID PPPPID PPPPPID
0 2015-01-02 456 2014-01-02 2014-01-02 2014-01-02 2014-01-02
1 2015-02-02 500 2014-02-02 2013-02-02 2012-02-02 2012-02-10
2 2010-12-04 300 2010-12-04 2010-12-04 2010-12-04 2010-12-04
除 CID (contract_ID) 之外的所有列都是日期时间。我想在数据框中添加另一列,用于计算每行中唯一日期时间的数量(目的是找出“链”中有多少合同)。
我尝试了 .count() 和 .sum() 方法的不同实现,但无法让它们逐行工作(输出是具有相同值的所有行)。
例子:
df_merged['COUNT'] = df_merged2.count(axis=1)
当我希望每一行都不同时,用“6”填充整个“COUNT”列。
删除 axis=1 参数会使整个列变为“NaN”
【问题讨论】:
标签: python datetime pandas nan