【发布时间】:2020-10-21 14:17:28
【问题描述】:
假设我有一个包含日期和 ID 列的数据框。这是一个时间序列数据集。所以我需要为这个数据框生成一个时间序列标识符。也就是说,我需要添加一个对应于每个唯一集的值。有没有办法做到这一点?
df = pd.DataFrame({'Date':[2012-01-01, 2012-01-01, 2012-01-01, 2012-01-02, 2012-01-02, 2012-01-03, 2012-01-03, 2012-01-03, 2012-01-04, 2012-01-01, 2012-01-04],
'Id':[1,2,3,4,5,6,7,8,9,10,11]})
print(df)
输出:
Date Id
2012-01-01 1
2012-01-01 2
2012-01-01 3
2012-01-02 4
2012-01-02 5
2012-01-03 6
2012-01-03 7
2012-01-03 8
2012-01-04 9
2012-01-01 10
2012-01-04 11
我需要根据日期的唯一性来排序
Date Id TimeID
2012-01-01 1 0
2012-01-02 4 0
2012-01-03 6 0
2012-01-04 9 0
2012-01-01 2 1
2012-01-02 5 1
2012-01-03 7 1
2012-01-04 11 1
2012-01-01 3 2
2012-01-03 8 2
2012-01-01 10 3
【问题讨论】:
-
顺便说一下,您是在对行进行排序,而不是对列进行排序。 (好的,这些是“日期”列中的行。但它算作排序行)
标签: pandas dataframe pandas-groupby unique