【发布时间】:2021-02-27 15:30:36
【问题描述】:
我是 R 的初学者,所以如果问题看起来很愚蠢,或者有明显的解决方案,或者已经在其他地方解决了,我提前道歉......
我有一个包含购买日期和客户 ID 的 df:
ANNEE Date clientID
1 2017 2017-01 aaa
2 2017 2017-01 bbb
3 2018 2018-01 aaa
4 2018 2018-02 aaa
5 2018 2018-01 bbb
6 2019 2019-01 aaa
7 2019 2019-01 ccc
8 2020 2020-01 ddd
9 2020 2020-01 ccc
我想知道上一年我的客户中有多少百分比出现在我的 df 中。在这个例子中,它看起来像:
dfObjective
Date Prop
2017 0
2018 1
2019 0.5
2020 0.5
我认为第一步是重新安排我的 df 以计算某一年的客户数量,无论他们购买了多少,我已经做到了(尽管我确信有更好的方法去做)
library(plyr)
clients = ddply(df, "ANNEE", summarise, Count = length(unique(ClientID)))
df2
ANNEE Count
2017 2
2018 2
2019 2
2020 2
但是我找不到如何计算上一年已经至少购买过一次的客户的比例......
提前谢谢你!
【问题讨论】: