【发布时间】:2020-04-17 07:03:23
【问题描述】:
我制作了一个这样的测试数据框:
gene <- as.factor(c('A','B','B','B','C','C','D'))
location <- as.integer(c(1,4,5,6,2,3,9))
df <- data.frame(gene, location)
> df
gene location
1 A 1
2 B 4
3 B 5
4 B 6
5 C 2
6 C 3
7 D 9
我想保留唯一的基因 A、B、C、D,并过滤掉非最高位置的重复基因。 (例如对于基因B,只保留位置6的B;对于基因C,只保留位置3的C)。
所以最终结果应该是这样的:
gene location
1 A 1
4 B 6
6 C 3
7 D 9
有人知道我该怎么做吗?
【问题讨论】: