【发布时间】:2016-12-02 18:28:10
【问题描述】:
在 sklearn 中,可以创建一个管道来优化机器学习设置的完整工具链,如以下示例所示:
from sklearn.pipeline import Pipeline
from sklearn.svm import SVC
from sklearn.decomposition import PCA
estimators = [('reduce_dim', PCA()), ('svm', SVC())]
clf = Pipeline(estimators)
现在,管道根据定义表示一个串行过程。但是,如果我想在管道的同一级别上比较不同的算法怎么办?假设我想在 PCA 之外尝试另一种特征转换算法,在 SVM 之外尝试另一种机器学习算法,例如树,并从 4 种可能的组合中获得最好的?这可以用某种并行管道表示,还是在 sklearn 中有一个元算法?
【问题讨论】:
标签: python machine-learning scikit-learn