之前都在写关于R的一些内容,最近研究朴素贝叶斯比较多,就来更一个python的方法实现朴素贝叶斯吧,更的内容是关于离散型变量的分类,利用UCI数据集上的car数据来做,至于理论部分,请观看我的另一篇文章,>https://blog.csdn.net/heirenmin/article/details/94611260
直接上代码,有什么问题,请在下方留言:
#coding:utf-8
#朴素贝叶斯算法 贝叶斯估计
import pandas as pd
import numpy as np
class NavieBayesB(object):
def getTrainSet(self):
trainSet = pd.read_csv("C://Users//MrDavid//Data_MS//car.csv")
trainSetNP = np.array(trainSet) #由dataframe类型转换为数组类型
trainData = trainSetNP[:,0:trainSetNP.shape[1]-1] #训练数据集
labels = trainSetNP[:,trainSetNP.shape[1]-1] #训练数据所对应的所属类型Y
return trainData, labels
def classify(self, trainData, labels, features):
labels = list(labels) #转换为list类型
#求先验概率
P_y = {}
for label in labels:
P_y[label] = (labels.count(label) ) / float(len(labels) )
#求条件概率
P = {}
for y in P

本文介绍如何使用Python实现朴素贝叶斯分类,特别是针对离散型变量的分类问题。作者通过UCI数据集上的car数据进行示例,详细代码已给出。对于理论部分,建议查阅相关文章。

4575

被折叠的 条评论
为什么被折叠?



