统计学习方法第四章朴素贝叶斯法-李航

Tian Fengshou

于 2017-04-26 23:50:38 发布

阅读量2.4k

点赞数 2

分类专栏： # 机器学习算法与原理 # 机器学习基础汇总文章标签：统计学习方法李航朴素贝叶斯法算法原理机器学习

数据科学与人工智能(软件联盟教材集合) 同时被 3 个专栏收录

42 篇文章

订阅专栏

机器学习基础汇总

31 篇文章

订阅专栏

机器学习算法与原理

16 篇文章

订阅专栏

本文介绍了朴素贝叶斯分类器的基本原理，包括基于特征条件独立假设的学习输入/输出联合概率分布方法，以及如何通过最大后验概率准则进行分类。同时，详细探讨了参数估计中的极大似然估计和贝叶斯估计。

摘要生成于 C知道，由 DeepSeek-R1 满血版支持，前往体验 >

第4章朴素贝叶斯法

朴素贝叶斯 (naive Bayes) 法是基于贝叶斯定理与特征条件独立假设的分类方法。对于给定的训练数据集，首先基于特征条件独立假设学习输入/输出的联合概率分布；然后基于此模型，对给定的输入x，利用贝叶斯定理求出后验概率最大的输出Y。

4.1 朴素贝叶斯法的学习与分类

基本方法

朴素贝叶斯法通过训练数据集学习X和Y的联合概率分布

P(X,Y)。

具体地，学习以

下先验概率分布及条件概率分布。

先验概率分布

条件概率分布

条件概率分布有指数级数量的参数，其估计实际是不可行的。朴素贝叶斯法对条件概率分布作了条件独立性的假设。条件独立性假设是说用于分类的特征在类确定的条件下都是条件独立的。

朴素贝叶斯法实际上学习到生成数据的机制，所以属于生成模型。

朴素贝叶斯法通过最大后验概率(MAP)准则进行类的判决，基于贝叶斯定理，后验概率为：

分母相同，则分类器可表示为

后验概率最大化等价于0-1损失函数时的期望风险最小化。

4.2 朴素贝叶斯法的参数估计

极大似然估计

先验概率的极大似然估计：

设第j个特征x^(j)可能取值的集合为

，条件概率的极大似然估计：

总结算法：

贝叶斯估计

用极大似然估计可能会出现所要估计的概率值为0的情况，使分类产生偏差，解决这一问题的方法是采用贝叶斯估计。条件概率的贝叶斯估计为：

式中lamda>=0。等价于在随机变量各个取值的频数上赋予一个正数。常取lamda=1，称为拉普拉斯平滑( Laplace smoothing)。同样，先验概率的贝叶斯估计为：

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。