【发布时间】:2018-01-09 13:42:04
【问题描述】:
数据集的样子
id agent final_col
1 1 A:A A
2 1 A:A A
3 2 B B
4 3 C C
5 4 A:C:C A:C
6 4 A:C:C A:C
7 4 A:C:C A:C
如何删除重复的条目,以便在 R 中拥有像 final_col 这样的干净列?
【问题讨论】:
-
您想只删除重复项还是重复的连续项? A:C:A 应该变成 A:C 还是 A:C:A?在第二种情况下,你可以做
sapply(agent, function(x){y=unlist(strsplit(x,':'));paste(y[cumsum(rle(y)$length)],collapse=":")}) -
删除重复,连续或不连续不相关,我相信我需要改写问题。
标签: r