【发布时间】:2018-06-21 20:36:22
【问题描述】:
我有一个包含四列的数据框:user_id、事件和时间
User_id 一个user_id,事件是“A”或“B”,时间就是时间。我需要计算每个“A”值之前出现的“B”值的数量。因此,如果在第一个“A”之前出现了 3 个“B”值,那么“A”的该实例将获得一个值为 3 的新列。如果“B”的下一个值之前有 25 个“B”实例A" 那么这将得到 25 的值。我认为自己是一个可靠的 R/dplyr 熟练工,但这让我很难过!谢谢。
user_id event date_time desired_column
1 B 2018-01-01 NA
1 B 2018-01-02 NA
1 B 2018-01-03 NA
1 B 2018-01-04 NA
1 B 2018-01-05 NA
1 A 2018-01-06 5
1 B 2018-01-07 NA
1 A 2018-01-08 1
2 B 2018-01-05 NA
2 B 2018-01-06 NA
2 A 2018-01-07 2
2 B ... NA
2 A ... 1
【问题讨论】: