朴素贝叶斯分类(Naive Bayesian classification)
贝叶斯分类是一类分类算法的总称,这类算法都以贝叶斯定理为基础,所以叫贝叶斯分类。而朴素贝叶斯模型(naive Bayes)是基于贝叶斯定理与特征条件独立假设的分类方法。朴素贝叶斯常常用于文本分类,然而该方法对于英文等语言很好用,对中文就不是很好。
一. 朴素贝叶斯分类算法的优缺点以及应用场景:
1. 优点:在数据较少的情况下仍然有效,可以处理多类别问题;
2. 缺点:对于输入数据的准备方式比较敏感、由于朴素贝叶斯的“朴素”特点,所以会带来一些准确率上的损失、需要计算先验概率,分类决策存在错误率、朴素贝叶斯有分布独立的假设前提,而现实生活中这些很难是完全独立的;
3. 应用场景:文本分类、垃圾文本过滤、情感预测、多分类预测、推荐系统