【发布时间】:2019-04-01 05:47:00
【问题描述】:
在 Date 和 UID 列中有以下具有重复值的数据框:
Date UID Score
2018-08-31 A 5
2018-08-31 B 3
2018-08-31 C 4
2018-05-31 A 4
2018-05-31 C 2
2018-05-31 A 4
2018-05-31 B 1
2018-05-31 A 3
2018-01-31 C 5
2018-01-31 A 3
2018-01-31 A 4
2018-01-31 C 2
2018-01-31 B 5
如果同一日期出现重复的 UID,请创建如下内容:
2018-08-31 A 5
2018-05-31 A 3.67
2018-01-31 A 3.5
2018-08-31 B 3
2018-05-31 B 1
2018-01-31 B 5
2018-08-31 C 4
2018-05-31 C 2
2018-01-31 C 3.5
我想要完成的是将原始数据帧拆分为多个时间序列,我可以将它们一起绘制并使用。在这种情况下,我该如何重塑这个数据框,以便我可以根据 UID 分数使用 3 个不同的时间序列?
我似乎被困在以下点......
df.groupby(['Date', 'UID'], as_index=False)['Score'].mean()
...我不知道如何正确地重塑它。
感谢任何反馈。
【问题讨论】:
标签: python pandas dataframe duplicates time-series