【发布时间】:2017-05-17 19:39:12
【问题描述】:
我的问题是继续这个问题Link
我有一个这样的数据集:
ID | Date
A 01/01/2015
A 02/01/2015
A 02/01/2015
A 02/01/2015
A 05/01/2015
B 01/01/2015
我想按参考日期对每个日期进行排名 - 2015 年 1 月 31 日。最接近参考日期的日期排在第 1 位,排在第 2 位,依此类推。结果如下所示:
ID | Date | Sequence
A 01/01/2015 3
A 02/01/2015 2
A 02/01/2015 2
A 02/01/2015 2
A 05/01/2015 1
B 01/01/2015 ...
虽然排名功能确实如此,但我也想保持所有联系。我怎么做?
另外,我正在处理一个巨大的数据集 - 大约。 3 亿行。因此,理想情况下,解决方案会很快。
【问题讨论】:
-
仅供参考,frank + ties.method="dense" 在 dplyr 中具有类似的 dense_rank。
标签: r data.table dplyr rank