【发布时间】:2018-02-28 17:34:17
【问题描述】:
我有以下数据框:
id dummy1 dummy2 dummy3 dummy4
2 1 1 1 0
3 0 0 0 1
4 1 1 1 0
5 0 0 1 0
我试图想出一种方法来查看某些虚拟变量是否比其他虚拟变量更频繁地出现。在此示例中,如果 dummy1 为 1,则所有其他虚拟对象也更有可能为 1。我尝试计算频率,但是对于两个以上的变量,它变得非常不方便。
为了给您提供更多背景信息,假人代表在超市购买的不同产品。我想看看购买一种产品(例如西红柿)的人是否更有可能购买不同类型的产品(生菜等)。
谢谢!
【问题讨论】:
-
“我现在不是在寻找特定的代码,只是关于包/回归模型等的想法。” - 这是关于stackoverflow的题外话,见stackoverflow.com/help/on-topic
标签: r regression frequency-analysis