【发布时间】:2021-11-13 05:19:03
【问题描述】:
我有这个示例数据框:
df <- data.frame(ID = c("5","5","5","5","5","5" ,"5" ,"5","5","5","5","14","14","14","14" ,"14","14"),
Date1= c("22/07/2014","22/07/2014","22/07/2014"
,"22/07/2014"
,"22/07/2014"
,"22/07/2014"
,"22/07/2014"
,"22/07/2014"
,"22/07/2014"
,"22/07/2014"
,"22/07/2014"
,"08/11/2016"
, "08/11/2016"
, "08/11/2016"
, "08/11/2016"
, "08/11/2016"
, "08/11/2016"),
Date2= c("01/01/2011"
,"01/08/2011"
,"01/12/2010"
,"10/11/2015"
,"22/07/2014"
,"01/01/2013"
,"23/04/2014"
,"01/01/2006"
,"01/01/2013"
,"01/10/2012"
,"01/08/2012"
,"14/04/2015"
,"01/10/2008"
,"01/10/2008"
,"14/05/2015"
,"11/04/2015"
,"05/10/2008"),
stringsAsFactors = F)
我将每个 ID 重复了几次。我需要得到一个每个 ID 只有 1 行的数据框。如您所见,每个患者在 df$date1 列中只有一个日期,因此为每位患者选择 1 行的条件是:选择日期之间的 最近 日期1 和日期 2。
我该怎么做?
谢谢
【问题讨论】:
标签: r date duplicates lubridate