【发布时间】:2019-10-29 08:59:05
【问题描述】:
我正在尝试在“id”列中创建一个没有重复值行的新数据框
我尝试了一些选项,但我想保持一致并利用dplyr。我尝试使用 distinct() 函数但无济于事。
library(tidyverse)
df <- structure(list(id = c("1-2", "1-3", "1-3", "1-4",
"1-5", "1-7", "1-7", "1-7", "1-9",
"1-22"), award_amount = c(3000, 596500, 1125000, 5881515,
155555, 686500, 207718, 250000, 750000, 3500000)), row.names = c(NA,
-10L), class = c("tbl_df", "tbl", "data.frame"))
s4 <- df %>%
distinct(id, .keep_all = TRUE)
s4
我希望“id”列中包含重复项的两行都不存在于最终表格中
【问题讨论】:
标签: r dplyr duplicates