【问题标题】:How to count number of unique character vectors within a subset of data如何计算数据子集中的唯一字符向量的数量
【发布时间】:2016-11-22 12:37:42
【问题描述】:

这是我的数据集的一个示例:

输入 -

(已删除)

我正在使用此代码按月对这个数据框进行子集:

simpleindoor.mean <- simple_trapindoors %>% group_by(month) %>% summarise(n=n(),mean = mean(bitingrate), stderror = std(bitingrate))

生成如下表:

  |Month| n |   mean| stderror|
  |-----|---|-------|---------|                          
  |May  | 12|   0.25|     0.13|
  |June | 21|   0.53|     0.12|
  |July | 21|   0.53|     0.12|

我想做的是在同一个函数中计算每个月内个人 FAMILY_ID 的数量,并将其作为新列添加到“simpleindoor.mean”。

FAMILY_ID 是一个字符向量。例如“6001-032”。因此,如果 5 月有 12 个唯一的 FAMILY_ID,则新数据列将在匹配“May”的行中显示 12。

我已经看到了一些示例,您可以在其中查找字符向量的特定实例,但我很难找到一个可以计算特定组中出现的唯一字符向量实例的示例。我该怎么做?

谢谢。

【问题讨论】:

  • 我找不到std函数
  • 这是我创建的用于计算标准误差的函数,抱歉我忘了提及。

标签: r vector dplyr


【解决方案1】:

你需要n_distinct

simple_trapindoors %>% group_by(month) %>% summarise(n=n(),mean = mean(bitingrate), stderror = std(bitingrate), 
                                                     UniqueFamilies = n_distinct(FAMILY_ID))

【讨论】:

  • 非常感谢,简单的回答,但我很难在网上找到解决方案!
猜你喜欢
  • 1970-01-01
  • 2012-04-08
  • 2018-03-11
  • 1970-01-01
  • 1970-01-01
  • 2014-07-08
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多