【问题标题】:Remove pair duplicates from two columns in a data table [duplicate]从数据表中的两列中删除对重复项 [重复]
【发布时间】:2020-02-25 11:15:02
【问题描述】:

DT 成为一个4 x 2 数据表,其中包含XY 两列,以及以下值:

X|Y
---
1 2
2 1
3 4
4 3

我想从数据表中删除重复的对,即DT 中的第 2 行和第 4 行。

【问题讨论】:

    标签: r data.table


    【解决方案1】:

    一个选项可能是:

    df[!duplicated(paste0(pmax(X, Y), pmin(X, Y))), ]
    
       X Y
    1: 1 2
    2: 3 4
    

    dplyr:

    df %>%
     group_by(ID = paste0(pmax(X, Y), pmin(X, Y))) %>%
     slice(1)
    

    或者base R:

    df[!duplicated(with(df, paste0(pmax(X, Y), pmin(X, Y)))), ]
    

    【讨论】:

      猜你喜欢
      • 2018-05-16
      • 2014-09-30
      • 2023-03-20
      • 1970-01-01
      • 2021-02-09
      • 2015-07-20
      • 2020-04-22
      • 2017-06-23
      相关资源
      最近更新 更多