【发布时间】:2016-06-10 01:12:47
【问题描述】:
机器学习中的“朴素”贝叶斯是什么意思?
【问题讨论】:
-
en.wikipedia.org/wiki/Naive_Bayes_classifier 的前几段有用吗?如果没有,你能澄清一下这个问题吗?
标签: machine-learning naivebayes data-science
机器学习中的“朴素”贝叶斯是什么意思?
【问题讨论】:
标签: machine-learning naivebayes data-science
机器学习中的朴素贝叶斯通常是指一组应用贝叶斯定理的监督学习算法。它本质上是一个“分类器”,可以帮助您根据一系列独立的“幼稚”假设对事物进行分类。例如,如果你想使用机器学习来帮助你识别潜在的水果……拿一根香蕉,它是弯曲的、黄色的,可能有 10 英寸长。这些属性中的每一个,“弯曲”、“黄色”、“10 英寸长”都是独立的属性,它们结合在一起形成了水果是香蕉的“概率”。有了这个“朴素”贝叶斯分类器,将来如果有其他种类的“水果”或不同的图像,具有相似属性的水果的描述,使用机器学习,你的朴素贝叶斯分类器可以将那些未来的水果或未知的东西分类为香蕉正确...(或错误),您可能希望识别更多“幼稚”特征以使您的分类器更准确,例如,可能有“黑色尖端”或“略带绿色”。
【讨论】:
之所以称为朴素,是因为模型假设特征之间是独立的。这是一个强烈的假设,通常是不正确的,这就是名称的原因。
尽管如此,朴素贝叶斯非常有效,并且在实践中以提供良好结果而闻名。
【讨论】:
朴素贝叶斯分类器是一种使用贝叶斯定理对对象进行分类的算法。朴素贝叶斯分类器假设数据点的属性之间具有很强的或朴素的独立性。朴素贝叶斯分类器的流行用途包括垃圾邮件过滤器、文本分析和医学诊断。
朴素贝叶斯分类器之所以朴素,是因为它假设所考虑的数据点的所有属性彼此独立。将水果分类为苹果和橙子的分类器会知道苹果是红色的、圆形的并且有一定的大小,但不会同时假设所有这些东西。毕竟橙子也是圆的。
朴素贝叶斯分类器不是单一算法,而是一系列利用统计独立性的机器学习算法。与更复杂的贝叶斯算法相比,这些算法相对容易编写和运行效率更高。
最流行的应用程序是垃圾邮件过滤器。垃圾邮件过滤器会查看电子邮件中的某些关键字,如果匹配,则将它们放入垃圾邮件文件夹中。
尽管名称如此,但它获得的数据越多,朴素贝叶斯分类器就越准确,例如来自用户将收件箱中的电子邮件标记为垃圾邮件。
【讨论】: