【问题标题】:How to handle unknown category in classification problems for Weka?Weka如何处理分类问题中的未知类别?
【发布时间】:2022-01-22 10:52:18
【问题描述】:

我必须在 Weka 中运行 J48 决策树算法来根据它们的 Type 属性对一些花进行分类。在我做任何事情之前,我必须清理我的数据,但是我发现我的 Type 属性具有以下值:

Type table example

我应该删除标签未知的数据吗?

我首先做的是使用所有脏数据运行我的分类器,我得到了 ~89% 的准确度和 0.85 的 F-Measure。

在我清理了我的数据(保留未知数据)后,我的模型的准确性降低了。如果我忽略所有带有 uknown 标签的数据,我的准确性会大大提高。

您的意见是什么,在这种情况下我应该怎么做? 非常感谢您的帮助

【问题讨论】:

    标签: machine-learning classification weka j48


    【解决方案1】:

    您应该删除未知数。通常,这意味着您尝试预测的属性没有编码,因此您正在添加噪声。

    得到模型后,用模型预测未知数。

    【讨论】:

      猜你喜欢
      • 2011-12-17
      • 2012-11-09
      • 2016-03-01
      • 2016-05-28
      • 2015-01-26
      • 2015-06-15
      • 2021-07-27
      • 1970-01-01
      • 2013-01-09
      相关资源
      最近更新 更多