朴素贝叶斯 (naive Bayes) 法是基于贝叶斯定理与特征条件独立假设的分类方法。对于给定的训练数据集,首先基于特征条件独立假设学习输入/输出的联合概率分布;然后基于此模型,对给定的输入x,利用贝叶斯定理求出后验概率最大的输出Y。

4.1 朴素贝叶斯法的学习与分类

基本方法

朴素贝叶斯法通过训练数据集学习X和Y的联合概率分布 P(X,Y)。 训练数据集

                                                T={(x1,y1),(x2,y2),...,(xn,yn)}由P(X,Y)独立同分布产生

具体地,学习以下先验概率分布及条件概率分布。

先验概率分布

第4章 朴素贝叶斯法

条件概率分布

第4章 朴素贝叶斯法

条件概率分布P(X=x|Y=ck)有指数级数量的参数,其估计实际是不可行的。

朴素贝叶斯法对条件概率分布作了条件独立性的假设。

第4章 朴素贝叶斯法

条件独立性假设是说用于分类的特征在类确定的条件下都是条件独立的。

朴素贝叶斯法实际上学习到生成数据的机制,所以属于生成模型。

朴素贝叶斯法通过最大后验概率(MAP)准则进行类的判决,基于贝叶斯定理,后验概率为:

第4章 朴素贝叶斯法

朴素贝叶斯分类器可表示为

第4章 朴素贝叶斯法

分母相同,则分类器可表示为

第4章 朴素贝叶斯法

后验概率最大化等价于0-1损失函数时的期望风险最小化。

损失函数:

第4章 朴素贝叶斯法

期望风险函数:

第4章 朴素贝叶斯法

后验概率最大化准则:

第4章 朴素贝叶斯法

4.2 朴素贝叶斯法的参数估计

极大似然估计

先验概率P(Y=ck)的极大似然估计:

第4章 朴素贝叶斯法  

设第j个特征x(j)可能取值的集合为第4章 朴素贝叶斯法,条件概率的极大似然估计:

第4章 朴素贝叶斯法   

总结算法:

第4章 朴素贝叶斯法

贝叶斯估计

用极大似然估计可能会出现所要估计的概率值为0的情况,使分类产生偏差,解决这一问题的方法是采用贝叶斯估计。条件概率的贝叶斯估计为:

第4章 朴素贝叶斯法

第4章 朴素贝叶斯法

同样,先验概率的贝叶斯估计为:

第4章 朴素贝叶斯法

相关文章:

  • 2021-05-21
  • 2021-06-28
猜你喜欢
  • 2022-01-12
  • 2021-08-28
  • 2021-09-28
  • 2021-12-19
  • 2021-08-08
  • 2021-12-30
  • 2021-08-08
相关资源
相似解决方案