【问题标题】:How to know probability output by a model corresponds to which class?如何知道模型输出的概率对应于哪个类?
【发布时间】:2022-01-19 06:37:36
【问题描述】:

我正在研究An Introduction to Statistical Learning with Application in R 的第三章,它讨论了分类模型。在第 4.7.3 节线性判别分析(实验室)中,该模型应用于名为 Smarket 的数据集,以预测股市的涨跌。这里上下预测的总数是由以下代码行完成的:sum(lda.pred$posterior[, 1]>= .5)sum(lda.pred$posterior[, 1] < .5),作者写道

注意模型输出的后验概率对应于 市场下跌的概率

然后验证这行代码是写的:

lda.pred$posterior [1:20 , 1] 

这给了 posterior probability of 20 observations

lda.class [1:20]

这给了classes corresponding to the probabilities of the observations given above

还有当我写这行代码时(感谢 ISLR 在线课程):

data.frame(lda.pred)[1:20, ]

给出classes and corresponding probabilites。可以看出,概率 = 0.5 的观测值被归类为上类。

这一切让我有点困惑。我的问题是in the first case 我们怎么知道当概率大于或等于 0.5 时预测会下降?因为使用contrast() 函数可以看出,R 创建了一个虚拟变量,其中 1 表示向上,这意味着该值对应于市场上涨的概率,而不是下跌的概率。再次in the second case 为什么概率 >= 0.5 的观察被归类为向上?第一种情况和第二种情况不矛盾吗?

【问题讨论】:

    标签: r machine-learning


    【解决方案1】:

    您正在预测两者,其中“向下”的后验概率为 1 - “向上”。恰好“Down”类存储在 lda.pred 的第一列 lda.pred$posterior [1:20 , 1]。 “向上”的概率存储在第二列中。 (lda.pred$posterior [1:20 , 2])。

    【讨论】:

      猜你喜欢
      • 2019-11-30
      • 1970-01-01
      • 1970-01-01
      • 2019-03-17
      • 2020-06-09
      • 2021-06-27
      • 2023-03-29
      • 2020-07-11
      • 1970-01-01
      相关资源
      最近更新 更多