【发布时间】:2020-02-25 11:15:02
【问题描述】:
让DT 成为一个4 x 2 数据表,其中包含X 和Y 两列,以及以下值:
X|Y
---
1 2
2 1
3 4
4 3
我想从数据表中删除重复的对,即DT 中的第 2 行和第 4 行。
【问题讨论】:
标签: r data.table
让DT 成为一个4 x 2 数据表,其中包含X 和Y 两列,以及以下值:
X|Y
---
1 2
2 1
3 4
4 3
我想从数据表中删除重复的对,即DT 中的第 2 行和第 4 行。
【问题讨论】:
标签: r data.table
一个选项可能是:
df[!duplicated(paste0(pmax(X, Y), pmin(X, Y))), ]
X Y
1: 1 2
2: 3 4
同dplyr:
df %>%
group_by(ID = paste0(pmax(X, Y), pmin(X, Y))) %>%
slice(1)
或者base R:
df[!duplicated(with(df, paste0(pmax(X, Y), pmin(X, Y)))), ]
【讨论】: