【问题标题】:Subset in Random Forest随机森林中的子集
【发布时间】:2017-07-23 01:48:08
【问题描述】:

在随机森林中..每个子集被随机抽取来构建树。但是我们如何才能确定我们正在采用一个独特的子集。

如果我的 N = 2,则生成 2 个随机样本来构建树。由于数据是随机选择的,因此相同的数据可以进入其他子集。我们怎样才能确保做到这一点。

有没有相同的机制?

【问题讨论】:

    标签: data-mining random-forest


    【解决方案1】:

    你没有。

    没有理由让它们脱节。例如,如果您只有很少的数据,则可能每次都需要考虑 90%。

    【讨论】:

    • 好的。因此,如果我有大量数据,如何确保每个子集/种子都是唯一的集合?
    猜你喜欢
    • 2014-11-21
    • 2019-07-21
    • 2016-07-23
    • 2021-03-30
    • 1970-01-01
    • 2017-06-13
    • 2012-04-19
    • 2015-09-16
    • 2017-03-15
    相关资源
    最近更新 更多