【发布时间】:2019-03-11 23:03:07
【问题描述】:
我有一个数据集缺少一些我想预测的 Y 值。因此,为了首先创建模型,我删除了 Na,使用此代码 -> RBall.dropna(subset=['NextHPPR'], inplace = True
import statsmodels.api as sm
from sklearn import linear_model
RBall.dropna(subset=['NextHPPR'], inplace = True)
X = RBall[['ReceivingTargets_x','SnapsPlayedPercentage','RushingAttempts_x', 'RushingAttempts_y']]
Y = RBall['NextHPPR']
lm = linear_model.LinearRegression()
model = lm.fit(X,Y)
这是删除 NA 之前我的数据的屏幕截图。 Note the NA's in NextHPPR, my Y variable in the regression
现在,我想使用我的模型返回并预测缺失的 Na。我知道这是一个基本问题,但这是我使用 python 的第一天。谢谢。
【问题讨论】:
-
如果“missing N/A”用 1 表示,而“not missing N/A”为零,你晚上可以尝试在单独的回归中使用它。
标签: python anaconda regression sklearn-pandas