【问题标题】:group by a dataframe and get a row of specific index within each group in r按数据框分组并在 r 中的每个组内获取一行特定索引
【发布时间】:2021-06-15 11:57:45
【问题描述】:

我有一个喜欢的df

ProjectID Dist
  1        x
  1        y
  2        z
  2        x
  2        h
  3        k
  ....     ....

和一个长度为unique(df$ProjectID) 的索引向量

  2        
  3        
  1        
  ....    

我想通过ProjectID获取Dist,其索引是项目ID对应的元素向量。所以我想要的结果看起来像

ProjectID Dist
  1        y
  2        h
  3        k
  ....     ....

我试过了

aggregate(XRKL ~ ID, FUN=..?, data=df)

但我不确定我可以将索引向量放在哪里。有没有办法从 dply ftns、tapply 或聚合中获得正确的结果?还是我需要自己做一个功能?谢谢。

【问题讨论】:

    标签: r aggregate tapply


    【解决方案1】:

    您可以在数据框本身中添加索引,然后从每个组中选择该行。

    inds <- c(2, 3, 1)
    
    df %>%
      mutate(inds = inds[match(ProjectID, unique(ProjectID))]) %>%
      #If ProjectID is sequential like 1, 2, 3
      #mutate(inds = inds[ProjectID]) %>%
      group_by(ProjectID) %>%
      slice(first(inds)) %>%
      ungroup() %>%
      select(-inds)
    
    #  ProjectID Dist 
    #      <int> <chr>
    #1         1 y    
    #2         2 h    
    #3         3 k    
    

    数据

    df <- structure(list(ProjectID = c(1L, 1L, 2L, 2L, 2L, 3L), Dist = c("x", 
    "y", "z", "x", "h", "k")), class = "data.frame", row.names = c(NA, -6L))
    

    【讨论】:

    • 运行顺畅!谢谢!
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多