【问题标题】:R filter rows based on common column values [duplicate]R根据公共列值过滤行[重复]
【发布时间】:2020-09-18 08:02:55
【问题描述】:

这有点简单,但我想不出解决方案。我有一个包含如下行的数据框:

ColumnA   ColumnB  
protein1  protein2  
protein2  protein1

其余的都是一样的。所以,我想只保留其中一个,因为它们是重复的以供我分析。我有一个包含蛋白质1和蛋白质2的载体。我根据该 vectoe 确定了这些列,但它总共有 100K 行。但是,我只是想不出有选择地删除它们的方法。 有人有想法吗?

【问题讨论】:

    标签: r dataframe filter duplicates


    【解决方案1】:

    您可以尝试igraph,如下所示

    library(igraph)
    unique(as_data_frame(graph_from_data_frame(df,directed = FALSE)))
    

    给了

          from       to
    1 protein1 protein2
    

    数据

    > dput(df)
    structure(list(ColumnA = c("protein1", "protein2"), ColumnB = c("protein2", 
    "protein1")), class = "data.frame", row.names = c(NA, -2L))
    

    【讨论】:

      猜你喜欢
      • 2020-10-02
      • 1970-01-01
      • 2016-10-05
      • 1970-01-01
      • 1970-01-01
      • 2017-05-04
      • 2022-01-14
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多