【发布时间】:2020-01-10 14:41:02
【问题描述】:
我正在运行一个包含大约 200.000 个观察值的代码,其中 10.000 个被处理,其余的我正在尝试使用包 MatchIt 进行匹配。
由于这些变量之一,出现了一条警告消息,我不知道是否应该忽略它。消息是:Glm.fit:拟合概率为 0 或 1
我正在运行的代码类似于下面的代码:
m.out <- matchit(var ~ VAR1 + VAR2 + VAR3 + VAR4 + VAR5, data = mydata, method = "nearest", exact = c("VAR1", "VAR3", "VAR5"))
为了说明,假设有问题的变量是“VAR5”。这个变量是一个字符变量,包含大约 200 个不同的文本。所以,我的问题是,这个警告是否是一个真正的问题,或者仅仅是因为这个变量中有太多选项与我的数据大小相比,并且因此无法找到治疗/控制预测?无论如何,我能做些什么来避免这个警告吗?
最好的,
【问题讨论】:
-
感谢您的链接,但我仍然感到困惑。对不起,我是编码初学者。我看到他们提供了一些回归函数的解决方案,但是我不知道如何在 MatchIt 包中实现这些解决方案!
-
,,, 我也不行。快速浏览一下文档,我想知道是否有一种方法可以使用 gam 距离(即
"GAMlogit"),它允许您通过matchit使用gam参数(paraPen)来惩罚系数论据distance.options。但我认为这可能最好转移到统计网站stats.stackexchange.com
标签: r propensity-score-matching