【发布时间】:2012-01-22 10:10:57
【问题描述】:
长期追随者,非常感谢您多年来的所有帮助!我有一个问题可能有一个简单的答案,但我在谷歌上搜索失败了,尝试各种子集和括号表示法也感觉很短。我敢打赌这里有人遇到过类似的问题。
我有一个带有一组重复 ID 的长格式数据集。我还有第三个变量,它可能与重复的不同。例如,如果您重新创建我的数据集:
x <- c("a", "a", "b", "c", "c", "d", "d", "d")
y <- c("z", "z", "z", "y", "y", "y", "x", "x")
z <- c(10, 20, 10, 10, 10, 10, 10, 20)
df <- cbind(x, y, z)
df <- as.data.frame(df)
names(df) <- c("id1", "id2", "var1")
df
当 id2 连接到同一个 id1 时,我想选择其中 id2 具有 10 和 20 的行,例如,'x' 有两个观察值连接到 id1 ('a') 有两个不同的var1 值(“10”和“20”)。
我想选择这些案例,并计算整个数据集中有多少这样的案例。提前致谢!
【问题讨论】: