美文网首页
朴素贝叶斯估计

朴素贝叶斯估计

作者: sadamu0912 | 来源:发表于2019-11-30 17:02 被阅读0次
"""朴素贝叶斯算法的实现"""
"""2019/4/12"""
import numpy as np
import pandas as pd

class NaiveBayes():
    def __init__(self,lambda_):
        self.lambda_=lambda_    #贝叶斯系数 取0时,即为极大似然估计
        self.y_types_count=None #y的(类型:数量)
        self.y_types_proba=None #y的(类型:概率)
        self.x_types_proba=dict() #(xi 的编号,xi的取值,y的类型):概率

    def fit(self,X_train,y_train):
        self.y_types=np.unique(y_train)  #y的所有取值类型
        X=pd.DataFrame(X_train)          #转化成pandas DataFrame数据格式,下同
        y=pd.DataFrame(y_train)
        # y的(类型:数量)统计
        self.y_types_count=y[0].value_counts()
        # y的(类型:概率)计算
        self.y_types_proba=(self.y_types_count+self.lambda_)/(y.shape[0]+len(self.y_types)*self.lambda_)

        # (xi 的编号,xi的取值,y的类型):概率的计算
        for idx in X.columns:       # 遍历xi
            for j in self.y_types:  # 选取每一个y的类型
                p_x_y=X[(y==j).values][idx].value_counts() #选择所有y==j为真的数据点的第idx个特征的值,并对这些值进行(类型:数量)统计
                for i in p_x_y.index: #计算(xi 的编号,xi的取值,y的类型):概率
                    self.x_types_proba[(idx,i,j)]=(p_x_y[i]+self.lambda_)/(self.y_types_count[j]+p_x_y.shape[0]*self.lambda_)

    def predict(self,X_new):
        res=[]
        for y in self.y_types: #遍历y的可能取值
            p_y=self.y_types_proba[y]  #计算y的先验概率P(Y=ck)
            p_xy=1
            for idx,x in enumerate(X_new):
                p_xy*=self.x_types_proba[(idx,x,y)] #计算P(X=(x1,x2...xd)/Y=ck)
            res.append(p_y*p_xy)
        for i in range(len(self.y_types)):
            print("[{}]对应概率:{:.2%}".format(self.y_types[i],res[i]))
        #返回最大后验概率对应的y值
        return self.y_types[np.argmax(res)]

def main():
    X_train=np.array([
                      [1,"S"],
                      [1,"M"],
                      [1,"M"],
                      [1,"S"],
                      [1,"S"],
                      [2,"S"],
                      [2,"M"],
                      [2,"M"],
                      [2,"L"],
                      [2,"L"],
                      [3,"L"],
                      [3,"M"],
                      [3,"M"],
                      [3,"L"],
                      [3,"L"]
                      ])
    y_train=np.array([-1,-1,1,1,-1,-1,-1,1,1,1,1,1,1,1,-1])
    clf=NaiveBayes(lambda_=0)
    clf.fit(X_train,y_train)
    X_new=np.array([2,"S"])
    y_predict=clf.predict(X_new)
    print("{}被分类为:{}".format(X_new,y_predict))

if __name__=="__main__":
    main()

朴素贝叶斯法通过训练数据集学习联合概率分布P(X,Y),具体做法是学习先验概率分布P(Y)与条件概率分布P(X|Y)(二者相乘就是联合概率分布),所以它属于生成模型。


image.png
image.png

贝叶斯分布例子

# load the iris dataset
from sklearn.datasets import load_iris
iris = load_iris()

# store the feature matrix (X) and response vector (y)
X = iris.data
y = iris.target

# splitting X and y into training and testing sets
from sklearn.model_selection import train_test_split
X_train, X_test, y_train, y_test = train_test_split(X, y, test_size=0.4, random_state=1)

# training the model on training set
from sklearn.naive_bayes import GaussianNB
gnb = GaussianNB()
gnb.fit(X_train, y_train)

# making predictions on the testing set
y_pred = gnb.predict(X_test)

# comparing actual response values (y_test) with predicted response values (y_pred)
from sklearn import metrics
print("Gaussian Naive Bayes model accuracy(in %):", metrics.accuracy_score(y_test, y_pred)*100)

image.png image.png

后验概率最大化

image.png image.png image.png

相关文章

  • 朴素贝叶斯(NBM)之后验概率最大化的含义 | 统计学习方法

    朴素贝叶斯 - 贝叶斯估计Python复现: 舟晓南:朴素贝叶斯(Bayes)模型python复现 - 贝叶斯估计...

  • 朴素贝叶斯法

    朴素贝叶斯法 朴素贝叶斯法的学习与分类 朴素贝叶斯法的参数估计 朴素贝叶斯实现 高斯朴素贝叶斯实现 使用 skle...

  • 十大数据挖掘算法之朴素贝叶斯

    一、什么是朴素贝叶斯 相关名词 条件概率 贝叶斯准则 贝叶斯决策理论 极大似然估计 1.1 条件概率 在谈朴素贝叶...

  • 朴素贝叶斯估计

    朴素贝叶斯法通过训练数据集学习联合概率分布P(X,Y),具体做法是学习先验概率分布P(Y)与条件概率分布P(X|Y...

  • 算法笔记(7)-朴素贝叶斯算法及Python代码实现

    朴素贝叶斯算法有三种类型,分别是贝努利朴素贝叶斯、高斯贝叶斯、多项式朴素贝叶斯。 贝叶斯公式 贝努利朴素贝叶斯 适...

  • 朴素贝叶斯算法介绍及优化

    朴素贝叶斯(Naive Bayes) 贝叶斯公式 朴素贝叶斯算法其实原理很简单,要理解朴素贝叶斯算法我们首先得知道...

  • 朴素贝叶斯法(NaiveBayes)

    朴素贝叶斯法(Naive Bayes) 朴素贝叶斯法是基于贝叶斯定力和特征条件独立假设的分类方法。 朴素贝叶斯法实...

  • 朴素贝叶斯算法

    问题 1. 什么是朴素贝叶斯 2. 怎么理解贝叶斯公式和朴素贝叶斯公式 3. 朴素贝叶斯算法流程是怎样...

  • 深度学习知识点汇总-机器学习基础(6)

    2.6 逻辑回归与朴素贝叶斯有什么区别? 逻辑回归是判别模型, 朴素贝叶斯是生成模型。 朴素贝叶斯属于贝叶斯,逻辑...

  • 朴素贝叶斯

    朴素贝叶斯 用处:朴素贝叶斯主要解决的是而分类的问题。 为什么叫朴素贝叶斯: 因为贝叶斯分类只做最原始,最简单的假...

网友评论

      本文标题:朴素贝叶斯估计

      本文链接:https://www.haomeiwen.com/subject/cdcvwctx.html