【发布时间】:2021-02-15 22:10:40
【问题描述】:
我有以下数据集,其中 ID 有重复项,其他列是范围从 0 t0 2 的分类列。如果可用,我想选择其他列的值不为零的唯一 ID。数据如下:
ID X Y R Z
1 0 2 0 1
1 0 2 0 0
2 1 0 0 1
3 1 1 0 1
3 1 1 1 1
4 0 0 1 0
4 0 1 1 0
我最喜欢的结果是:
ID X Y R Z
1 0 2 0 1
2 1 0 0 1
3 1 1 1 1
4 0 1 1 0
我正在使用 dplyr 和 group_by
谢谢!
【问题讨论】:
-
baseR 选项
aggregate(. ~ ID, df1, max)
标签: r dplyr group-by duplicates