【发布时间】:2016-12-12 22:56:50
【问题描述】:
我正在尝试将isolation forest algorithm 与 Python scikit-learn 一起使用。
我不明白为什么我必须生成集合 X_test 和 X_outliers,因为当我获取数据时,我不知道其中是否存在异常值。但也许这只是一个例子,我不必为每个案例生成和填充这些集合。我认为隔离林不必接收干净的X_train(没有异常值)。
我误解了算法吗?我是否必须使用其他算法(我考虑过一类 SVM,但它的X_train 必须尽可能干净)?
隔离森林算法是无监督算法还是有监督算法(如随机森林算法)?
【问题讨论】:
标签: python algorithm scikit-learn