【问题标题】:How to create a table by using the variables of a column from a dataset in R?如何使用 R 中数据集中的列变量创建表?
【发布时间】:2020-04-14 22:39:20
【问题描述】:

我有一个data.frame,就像:

data.frame("Hhold Id" = c(173,174,174,175,176,176,176), "Individuals" = c(1,1,2,1,1,2,3))

个人表示该家庭的第 n 个个人。即,例如Hhold 173包括一个个体,而Hhold 176由三个个体组成。我想获得一个新表,该表指示每个家庭有多少人,而无需复制 Hhold Id。如:

data.frame("Hhold Id" = c(173,174,175,176), "Individuals" = c(1,2,1,3))

我已经尝试过uniquegroup by 函数,但找不到解决方案。提前致谢。

【问题讨论】:

  • as.data.frame(table(df$Hhold.Id)) 怎么样?

标签: r data-science


【解决方案1】:

使用data.table库

data.table(data)[,list(Individuals=max(Individuals)),list("Hhold Id"=Hhold.Id)]

【讨论】:

    【解决方案2】:
    library(dplyr)
    
    df <- data.frame("Hhold Id" = c(173,174,174,175,176,176,176), "Individuals" =  
       c(1,1,2,1,1,2,3))
    
    df_summary <- df %>%
      group_by(Hhold.Id) %>%
      summarise(Individuals = max(Individuals))
    

    【讨论】:

    • 您可能会考虑为您的答案添加更多上下文,而不是仅使用代码的答案。这可以帮助每个人从您的答案中得到更好的结果。您可以在此处阅读如何创建更好的答案:stackoverflow.com/help/how-to-answer
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2023-03-26
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2019-09-11
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多