【发布时间】:2017-07-23 01:48:08
【问题描述】:
在随机森林中..每个子集被随机抽取来构建树。但是我们如何才能确定我们正在采用一个独特的子集。
如果我的 N = 2,则生成 2 个随机样本来构建树。由于数据是随机选择的,因此相同的数据可以进入其他子集。我们怎样才能确保做到这一点。
有没有相同的机制?
【问题讨论】:
在随机森林中..每个子集被随机抽取来构建树。但是我们如何才能确定我们正在采用一个独特的子集。
如果我的 N = 2,则生成 2 个随机样本来构建树。由于数据是随机选择的,因此相同的数据可以进入其他子集。我们怎样才能确保做到这一点。
有没有相同的机制?
【问题讨论】:
你没有。
没有理由让它们脱节。例如,如果您只有很少的数据,则可能每次都需要考虑 90%。
【讨论】: