【发布时间】:2021-09-16 12:03:04
【问题描述】:
感谢您的帮助!我在 R 中有一个包含两列分类变量的数据框,如下所示:
rowA <- c("Square", "Circle", "Triangle", "Square", "Circle", "Triangle", "Square", "Circle", "Triangle")
rowB <- c("Circle", "Square", "Square", "Square", "Circle", "Circle", "Triangle", "Triangle", "Triangle")
df1 <- data.frame(rowA, rowB)
print(df1)
当我们打印它时,它看起来像这样:
rowA rowB
1 Square Circle
2 Circle Square
3 Triangle Square
4 Square Square
5 Circle Circle
6 Triangle Circle
7 Square Triangle
8 Circle Triangle
9 Triangle Triangle
我想计算 rowA 和 rowB 中每个类别组合的频率。这就是我所关注的——这些组合是可逆的,这意味着对于我们的目的,“方形 - 圆形”与“圆形 - 方形”相同,我们希望将它们加在一起。理想的输出应该是这样的:
Pair Count
Square - Circle 2
Square - Triangle 2
Square - Square 1
Circle - Triangle 2
Circle - Circle 1
Triangle - Triangle 1
如果有人有任何建议,我会很高兴,谢谢!
编辑:帖子被标记为重复问题,但我不同意建议的帖子充分回答了我的问题(因此,经过大量挖掘,我首先提出了问题)。非常感谢这里独特而简单的答案。
【问题讨论】:
-
如果您认为建议的副本不能回答您的问题,您需要向我们展示他们为什么不这样做。只是说你“不同意”即使你是对的,我们也没什么好继续的。
标签: r combinations categorical-data