【问题标题】:How to interpret the output of a multiclasses classification using xgboost package in R?如何使用 R 中的 xgboost 包解释多类分类的输出?
【发布时间】:2023-03-22 12:46:01
【问题描述】:
我是 XGBOOST 包的新手,我想用它来解决多类分类问题。
我现在有 30 个类(或标签),我已将它们转换为整数 (0 - 29)。然后我在数据集上运行 XGBOOST 包中的 xgboost() 方法。建立模型后,我使用 predict() 方法来预测一个新的测试数据。最后,我得到了一个数字向量作为最终输出。顺便说一句,所有数字都在 0 和 1 之间。
那么现在我该如何解释输出呢?是这个概率吗?但是我怎么知道应该与哪个类相关呢?
谢谢
【问题讨论】:
标签:
r
multilabel-classification
xgboost
【解决方案1】:
我刚得到它!输出是100,000 * 30值的矩阵。因此,每30个数字都对应于一个特定的实例,这意味着每个数字都是该实例是标签的概率。
例如:
矩阵[1]是prob(instance0 == label0)
矩阵[32]是prob(instance1 == label1)
矩阵[33] = prob(instance1 == label3)