【问题标题】:how can i make a filter to exclude repeated data on a data frame in R system?如何制作过滤器以排除 R 系统中数据框中的重复数据?
【发布时间】:2021-12-08 04:58:57
【问题描述】:

我有一个这样的数据框:

question <- data.frame("cars"=c(1,1,2,2,34),"bike"=c(1,1,2,2,37),"motorcycle"=c(3,3,2,2,45),
                   "trycicle"=c(3,3,4,4,56),"skate"=c(1,1,4,4,78))

我想做一个过滤器来删除重复的数据并保持不同的数字,这在R系统中可以吗?

新的数据框必须是这样的:

question2 <- data.frame("cars"=c(NA,NA,NA,NA,34),"bike"=c(NA,NA,NA,NA,37),"motorcycle"=c(NA,NA,NA,NA,45),
                   "trycicle"=c(NA,NA,NA,NA,56),"skate"=c(NA,NA,NA,NA,78))

【问题讨论】:

    标签: r dataframe filter


    【解决方案1】:

    您可以使用duplicated 将重复值转换为NA

    library(dplyr)
    
    question %>%
      mutate(across(.fns = 
             ~replace(., duplicated(.) | duplicated(., fromLast = TRUE), NA)))
    
    #  cars bike motorcycle trycicle skate
    #1   NA   NA         NA       NA    NA
    #2   NA   NA         NA       NA    NA
    #3   NA   NA         NA       NA    NA
    #4   NA   NA         NA       NA    NA
    #5   34   37         45       56    78
    

    在基础 R 中,您可以使用 lapply -

    question[] <- lapply(question, function(x) 
                    replace(x, duplicated(x) | duplicated(x, fromLast = TRUE), NA))
    

    【讨论】:

      猜你喜欢
      • 2020-09-15
      • 2018-01-07
      • 1970-01-01
      • 2017-03-18
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2021-11-09
      • 1970-01-01
      相关资源
      最近更新 更多