【发布时间】:2015-09-30 14:50:12
【问题描述】:
我正在为我的项目使用 RandomForestRegressor(来自 python 中的伟大 Scikt-Learn 库), 它给了我很好的结果,但我认为我可以做得更好。 当我为“fit(..)”功能提供功能时, 将分类特征作为二元特征会更好吗?
示例: 而不是:
===========
continent |
===========
1 |
===========
2 |
===========
3 |
===========
2 |
===========
制作类似的东西:
===========================
is_europe | is_asia | ...
===========================
1 | 0 |
===========================
0 | 1 |
===========================
因为它像一棵树一样工作,也许第二个选项更好, 还是第一个选项的工作方式相同? 非常感谢!
【问题讨论】:
标签: python tree machine-learning scikit-learn random-forest