【发布时间】:2019-07-19 13:13:14
【问题描述】:
我使用 GridsearchCV 训练了多个不同的模型。在训练期间,数据排序如下:
[feature 1, feature 2, feature 3, feature 4]
我想使用已保存(使用 joblib 保存)模型来预测新数据。新的/看不见的数据排序如下:
[feature 1, feature 2, feature 4, feature 3]
训练数据和新数据之间的特征相同(即特征 1 表示两个数据集之间的相同事物)。
输入数据的顺序对 scikit 学习有影响吗?它是通过类似于 pandas iloc 的索引引用还是通过类似于 pandas loc 的名称引用?
【问题讨论】:
标签: python scikit-learn