【发布时间】:2019-06-06 19:17:44
【问题描述】:
我正在尝试根据“类别”变量对数据进行子集化。更具体地说,该类别有两个级别:a 和 b。示例数据如下所示:
id <- c(1,2,2,2,1,1,2,2,1,2)
category <- c("a", "b", "a", "a", "b", "a","a", "b","a","a")
data <- data.frame("id"=id, "category"=category)
> data
id category
1 1 a
2 2 b
3 2 a
4 2 a
5 1 b
6 1 a
7 2 a
8 2 b
9 1 a
10 2 a
我想获得在类别变量中只有超过 3 个 a 或 b 计数的 id 。我先看桌数, 表格可能如下所示:(这部分不一定打印出来)
a b
1 3 1
2 4 2
然后选择与我的标准匹配的 id 。
a b
2 4 2
提前致谢!
【问题讨论】: