【发布时间】:2016-06-21 07:38:36
【问题描述】:
我有一个 pandas 数据集,其中包含 300 多个连续和分类的预测变量。目标变量是分类变量,值为 0 或 1。我将执行逻辑回归,我想使用 scikit learn 模块中的递归特征选择来获得预测变量的候选名单。我知道如何在 rfe.fit(x,y) 函数中分配目标变量。如何将所有其他变量分配给 x 矩阵?
谢谢!
【问题讨论】:
-
“将所有其他变量分配给 x 矩阵”是什么意思?对于分类值,您已经有 0 或 1。对于其他特征,您需要对它们进行归一化,以便它们的值也落入 [0,1]。这就是你要找的吗?
标签: python pandas scikit-learn