公式推导:

优点:
(1)朴素贝叶斯模型发源于古典数学理论,有稳定的分类效率。
(2)对小规模的数据表现很好,能个处理多分类任务,适合增量式训练,尤其是数据量超出内存时,我们可以一批批的去增量训练。
(3)对缺失数据不太敏感,算法也比较简单,常用于文本分类。
缺点:
(1)理论上,朴素贝叶斯模型与其他分类方法相比具有最小的误差率。但是实际上并非总是如此,这是因为朴素贝叶斯模型给定输出类别的情况下,假设属性之间相互独立,这个假设在实际应用中往往是不成立的,在属性个数比较多或者属性之间相关性较大时,分类效果不好。而在属性相关性较小时,朴素贝叶斯性能最为良好。对于这一点,有半朴素贝叶斯之类的算法通过考虑部分关联性适度改进。
(2)需要知道先验概率,且先验概率很多时候取决于假设,假设的模型可以有很多种,因此在某些时候会由于假设的先验模型的原因导致预测效果不佳。
(3)由于我们是通过先验和数据来决定后验的概率从而决定分类,所以分类决策存在一定的错误率。
(4)对输入数据的表达形式很敏感。
本文主要对朴素贝叶斯模型进行分析。它源于古典数学理论,有稳定分类效率,对小规模数据表现好,能处理多分类任务,适合增量训练,对缺失数据不敏感,常用于文本分类。但也存在不足,如属性独立性假设常不成立、需先验概率、分类决策有错误率、对输入数据表达形式敏感等。
朴素贝叶斯&spm=1001.2101.3001.5002&articleId=95985453&d=1&t=3&u=fd672bdaa164400a94d502153eac28d5)
4518

被折叠的 条评论
为什么被折叠?



