【发布时间】:2015-03-22 13:51:38
【问题描述】:
我尝试在数据集上拟合随机森林。花了几个小时,但最终安装好了。使用的命令是: 模型
模型报告如下:
#随机森林
13737 个样本 52 预测器 5 类:'A'、'B'、'C'、'D'、'E'
无预处理 重采样:自举(25 次)
样本量汇总:13737, 13737, 13737, 13737, 13737, 13737, ...
跨调整参数重新采样结果:
mtry Accuracy Kappa Accuracy SD Kappa SD
2 0.9888012 0.9858367 0.001844763 0.002329859
27 0.9882821 0.9851812 0.001874991 0.002365894
52 0.9820495 0.9773000 0.003680805 0.004649905
精度用于选择使用最大值的最佳模型。 用于模型的最终值是 mtry = 2。
#当我对训练数据进行预测时,我得到了 100% 的准确率。
预测
表(预测,训练$classe)
预测 A B C D E
A 3906 0 0 0 0
B 0 2658 0 0 0
C 0 0 2396 0 0
D 0 0 0 2252 0
E 0 0 0 0 2525
我预计它会达到模型报告的 ~98.9%。
我错过了什么?
感谢和问候,
【问题讨论】:
标签: r