【发布时间】:2021-06-18 14:33:15
【问题描述】:
我在 R 中有一个数据框,其中一列是 ID 号的数字因子,多次遇到相同的 ID ,一列是年龄,最后一列是由 10 个级别组成的状态。如果只有一个重复 ID 在状态列中的任何时候具有特定值,我正在尝试删除所有重复的 ID 行。
这是我的代码,如果其中任何一个具有列出的状态级别,我将尝试删除所有重复的 ID
D1 = DD %>%
group by(ID, status)%>%
filter(!duplicated(ID) & if(any(status = c('11','13','14','19','20'))))
example data actual data is has over 100000 rows
这是一个示例数据集。唯一不应删除的重复项是 ID-987 id.data
【问题讨论】:
-
您能否使用
dput在您的问题中包含DD的样本
标签: r filter dplyr duplicates