【发布时间】:2018-07-14 04:00:28
【问题描述】:
我有一个包含日期列的数据框,我想创建一个新列来告诉我数据集包含多少相同的日期。这是原始数据集的一个最小示例:
df1:
date
2017/01/03
2017/01/03
2017/01/04
2017/01/04
2017/01/04
2017/01/05
我想创建这个date_count,所以目标数据集是:
df1:
date date_count
2017/01/03 2
2017/01/03 2
2017/01/04 3
2017/01/04 3
2017/01/04 3
2017/01/05 1
创建df1的实际代码:
dict1 = [{'date': '2017/01/03', 'date_count': 2},{'date': '2017/01/03', 'date_count': 2},
{'date': '2017/01/04', 'date_count': 3},{'date': '2017/01/04', 'date_count': 3},
{'date': '2017/01/04', 'date_count': 3},{'date': '2017/01/05', 'date_count': 1}]
df = pd.DataFrame(dict1, index=['s1', 's2','s3','s1','s2','s3'])
【问题讨论】:
-
你知道
groupby吗? -
我现在做。但这只会给我一个列出发生的输出,对吗?
-
df.groupby('date').count() -
然后
transform('count') -
我已经添加了原始df和上面的目标df