【发布时间】:2012-07-07 08:53:29
【问题描述】:
我想对数据框进行子集化,以仅包含具有三列唯一组合的行。我的情况类似于this 问题中提出的情况,但我也想保留数据中的其他列。这是我的例子:
> df
v1 v2 v3 v4 v5
1 7 1 A 100 98
2 7 2 A 98 97
3 8 1 C NA 80
4 8 1 C 78 75
5 8 1 C 50 62
6 9 3 C 75 75
请求的输出将是这样的,我正在寻找仅基于 v1、v2 和 v3 的独特案例:
> df.new
v1 v2 v3 v4 v5
1 7 1 A 100 98
2 7 2 A 98 97
3 8 1 C NA 80
6 9 3 C 75 75
如果我能恢复非唯一行,那也太好了:
> df.dupes
v1 v2 v3 v4 v5
3 8 1 C NA 80
4 8 1 C 78 75
5 8 1 C 50 62
我在 sql (here) 中看到了一个有关如何执行此操作的相关问题,但我无法在 R 中解决此问题。我敢肯定它很简单,但使用 unique() 和 subset() 并没有卓有成效。提前致谢。
【问题讨论】: