【发布时间】:2020-06-29 17:07:34
【问题描述】:
我在 python 中有一个回归问题。我的输入数据集如下所示:
x= 均值、偏差、方差、varianceOfVariance
y = 走、慢、跑、保持
X 特征由值组成,Y 被二进制标记为 4 个类别之一。所以它可以是或步行或慢速或跑步或保持。 data.head() 看起来像这样。
我可以使用 train_test_split() 方法在 X_train、X_test、y_train、y_test 中拆分 pd 数据帧。
我想创建一个回归器(前 SVM,或线性回归器),以如下格式对这些标签进行预测:70% 步行,25% 慢速,0% 运行,5% 保持。
它必须是概率的,我尝试使用分类器,并将标签组合成一个变量,但现在我正在尝试概率机会。
使用 sklearn 库可以做到这一点,如果可以,怎么做?我想不通。
【问题讨论】:
标签: python pandas scikit-learn regression probability