【发布时间】:2018-10-17 13:30:44
【问题描述】:
我有一个庞大的数据库,我需要使用条件语句运行不同的回归。 所以我看到了这样做的选项:1)在回归中包括命令数据子集(industrycodes==12)和2)我没有获得相同的结果,就像将数据切割成家具==12时的值一样。他们应该是一样的。 有人可以帮我写代码吗,我想我有这个问题。 我举了一个非常基本的例子来解释它。
ID roa employees industrycodes
1 0,5 10 12
2 0,3 20 11
3 0,8 15 12
4 0,2 12 12
5 0,7 13 11
6 0,4 8 12
所以我首先创建子数据库进行比较(当行业代码为 12 时)
data2<-data1[data1$industrycodes==12,]
我在这里运行回归:
1) 对于整个数据仅采用行业代码==12 --> 这里我有 6 个观察结果
summary(lm(data1$roa~data1$employees, data=subset(data1,industrycodes==12)))
2) 在行业代码==12 时切割样本 --> 这里当然我有 4 个观察结果
summary(lm(data2$roa~data2$employees),data=data2)
有什么想法可能是错的吗?谢谢!
【问题讨论】:
标签: r conditional regression subset