【发布时间】:2021-10-27 10:31:35
【问题描述】:
我有一个适合固定效应模型的面板数据集:
data <- data.frame(ID = c(1,1,1,1,2,2,3,3,3),
year = c(1,2,3,4,1,2,1,2,3),
progenyMean = c(90,78,92,69,86,73,82,85,91),
damMean = c(89,89,72,98,95,92,94,87,89)
ID, year, progenyMean, damMean
1, 1, 70, 69
1, 2, 68, 69
1, 3, 72, 72
1, 4, 69, 68
2, 1, 76, 75
2, 2, 73, 80
3, 1, 72, 74
3, 2, 75, 67
3, 3, 71, 69
# Fixed Effects Model in plm
fixed <- plm(progenyMean ~ damMean, data, model= "within", index = c("ID","year"))
我用蓝色的固定效应回归线绘制了 progenyMean 与 damMean:
我想识别固定效应回归线上方的ID,并为此信息创建一个数据表。每个唯一的ID 都有几个数据点,所以它是可能的ID 在回归线上下都有点。
我已经计算了固定效应模型 (fitted) 的预测值并确定了线上方的数据点:
fitted <- as.numeric(fixed$model[[1]] - fixed$residuals)
above <- data$progenyMean3Y > fitted
above
[1] TRUE FALSE TRUE FALSE TRUE FALSE TRUE FALSE FALSE TRUE FALSE
[12] FALSE FALSE FALSE TRUE FALSE TRUE FALSE FALSE TRUE FALSE TRUE
[23] FALSE TRUE TRUE FALSE FALSE TRUE TRUE FALSE FALSE TRUE FALSE
是否可以使用data.table 创建一个表,其中每一行都是唯一的ID,并且有两列,above 和below,它们计算高于/低于表的数据点数ID 的回归线?
【问题讨论】:
标签: r ggplot2 data.table regression mixed-models