【发布时间】:2018-06-27 23:52:45
【问题描述】:
我有一个包含因子变量 obs、日期、组 ID、所有者 ID、损坏类型和应用类型的数据集。
样本数据:
obs Date GroupID Owner ID Damage Type Type
1 5/8/2012 268dun56 125 front Initial
2 6/28/2012 924bndg32 126 driver front Completed
3 5/1/2015 963pkj23 127 passenger rear Completed
4 3/25/2016 9647kjh25 128 windshield Initial
5 3/26/2016 9647kjh25 128 windshield Initial
基于此,我知道 obs 5 和 6 是同一辆车,因为 group id 和 owner id 是唯一标识符。我想删除所有重复的条目,但最早出现的除外,但我不确定如何做到这一点。实际数据集来自汽车经销商超过 3 年,因此手动删除行不是一种选择。 我尝试了几种删除重复条目的方法,但是由于条目并不完全相同,因此没有任何效果。
【问题讨论】:
标签: r duplicates