【问题标题】:Different results between the Bernoulli Naive Bayes in NLTK and in scikit-learnNLTK 和 scikit-learn 中的伯努利朴素贝叶斯结果不同
【发布时间】:2013-03-21 21:32:10
【问题描述】:

在使用 NLTK 中的伯努利朴素贝叶斯算法和 scikit-learn 模块中的算法对文本(仅分为两类)进行分类时,我得到了完全不同的结果。尽管两者之间的总体准确度相当(尽管远非相同),但 I 型和 II 型错误的差异是显着的。特别是,NLTK 朴素贝叶斯分类器给出的 I 类错误多于 II 类错误,而 scikit-learn 则相反。这种“异常”似乎在不同的特征和不同的训练样本中是一致的。是否有一个原因 ?两者哪个更值得信赖?

【问题讨论】:

    标签: nltk scikit-learn document-classification


    【解决方案1】:

    NLTK 没有实现伯努利朴素贝叶斯。它实现多项朴素贝叶斯,但只允许二元特征。

    【讨论】:

      猜你喜欢
      • 2016-02-14
      • 2019-08-04
      • 2018-06-11
      • 2015-09-16
      • 2016-02-26
      • 2021-02-09
      • 2019-03-22
      • 2017-06-21
      相关资源
      最近更新 更多