模式识别和机器学习 笔记 第二章 概率分布

这章主要介绍概率分布及其特性。这些基本的分布可以像堆积木一样形成更复杂的模型。讨论了一些统计学的关键概念,比如 Bayesian inference。概率分布的一个角色是:给定一个随机变量x有限集合的观察值x1,x2….xn,对概率分布p(x)进行建模,即概率密度估计。首先介绍离散型贝努力分布、二项式分布和多项式分布和连续型的Gaussian分布。一个特殊
的问题就是参数化估计问题,根据观察的值来估计概率分布的参数,frequentist方式,可以采用似然函数的方法,贝叶斯方式,首先引入一个参数的先验分布,然后根据观察数据计算后验分布。本章另一个重要的概念是共轭先验,它让后验分布具有和先验一样的函数形式,这能够极大的简化贝叶斯分析。比如多项式的参数的共轭分布式是Dirichlet分布,高斯分布期望参数的共轭先验仍是高斯分布。这些分布都是指数系列的分布,他们具有很多重要的性质。参数估计的方式的缺陷是首先假定了分布的函数,这在一些应用中并不适用,一种可选择的方式是非参数密度估计,它的分布形式很大程度依赖于现有数据的规模,这些模型仍然有隐含参数,但是它只是用于控制模型的复杂度而不是分布的形式。本章最后介绍了三个非参数的估计histograms,最邻近方法,核方法。

2.1 二元变量
首先介绍二元分布和二项式分布,给出了期望和方差,并通过最大似然函数的方法估计参数u的值。
2.1.1
这节介绍了beta分布,介绍了关于参数引入先验分布,然后通过观察似然函数因子,选择先验的形式使其和似然函数具有相似的形式,然后根据先验概率和似然函数的乘积计算出后验概率,和先验具有一样的形式,这种特性被称为共轭。beta分布是二项分布的共轭先验分布,介绍了超参数的概念。
通过共轭分布,可以每次观察一个数据,然后计算后验分布,并将先验分布更新为后验分布,继续观察学习,这种方式被称为顺序学习。
2.2 多元变量
这节首先介绍了使用1 of k的形式表示的多元分布,通过最大似然函数的方法估计参数u,然后引入k个变量的联合分布多项式分布。
2.2.1 Dirichlet distribution
首先通过研究多项式参数分布参数uk的先验分布,引入了Dirichlet distribution。引入一个simplex的概念,关于simplex,二维的就是以(0,1)和(1,0)为端点的线段,三维的就是以(0,0,1),(0,1,0),(0,0,1)为端点的三角形的内部。然后通过将先验和似然函数相乘得到后验分布,仍然是Dirichlet distribution。事实上Dirichlet分布是多项式分布的共轭先验。现在比较火的topic model、LDA就是使用了Dirichlet distribution。
2.3 高斯分布
在第一章已经介绍了高斯分布,引入了D-维变量的高斯分布,给出了期望和协方差矩阵。。高斯分布的最大增益仍然是高斯分布。多个随机变量之和的均值,随着变量的增加,越趋向于高斯分布。
随后介绍了高斯分布的几何属性,引入了马氏距离(Mahalanobis distance)。然后考虑协方差矩阵式对称矩阵,通过其特征值和特征矩阵表示特征矩阵及其逆矩阵。引入一个新的坐标系统,被定义为正交矩阵ui从xi坐标移动并做了旋转变换,然后介绍在新的坐标系下高斯分布的形式。
2.3.1 高斯条件分布
把一个多维的变量分成两部分,然后通过分块矩阵运算,得到
μa|b = μa + ΣabΣ^−1bb (xb − μb)
Σa|b = Σaa − ΣabΣ^−1bb Σba.
2.3.2 高斯边缘分布
联合分布p(xa,xb)如果是高斯分布,那么条件分布仍然是高斯分布。边缘分布也是
高斯分布。根据联合分布的指数二次形式可以有效地得到边缘分布,进而得到均值
和方差。
联合分布的二次形式可以使用精度的分块矩阵来表示,我们的目的是对xb进行积分,
首先考虑和xb相关的项,与xb相关的项是一个标准的二次形式。
我们通过对指数部分积分,然后进行规范化即可,又由于标准的高斯分布,规范化的
分母只和方差矩阵相关,和均值无关。我们可以得到很简洁的使用分块精度矩阵表示
的均值和方差:
E[xa] = μa
cov[xa] = Σaa

2.3.3 关于高斯变量的贝叶斯理论
给定高斯分布p(x)和条件分布p(y|x)
p(x) = N(x|μ,Λ^-1)
p(y|x) = N(y|Ax + b,L^-1)
关于y的边缘分布和x关于y的条件分布为:
p(y) = N(y|Aμ + b,L?1 + AΛ^-1AT)
p(x|y) = N(x|Σ{A^T L(y-b)+Λμ},Σ)
Σ = (Λ + A^T LA)^1
2.3.4 高斯分布的最大似然估计(待续)
<<模式识别与机器学习 (Pattern Recognization and Maching Learning)>>(PRML) 总结 \quadBishop 的大作《模式识别与机器学习》(Pattern Recognization and Maching Learning),简称为PRML,这本书被认为是贝叶斯方法的扛鼎之作,我有幸忙里偷闲地把这本书通读了一遍并且也把各个章节的习题几乎完成了一遍,可以见我的博客,作为看完这本书最后一个环节,我想为我看完这本书做一个总结。总结分为如下几个部分,分别是阅读此书可以采取的方法,本书主要内 阅读详情

相关推荐

Python实现12种概率分布(附代码)

今天给大家带来的这篇文章是关于机器学习的,机器学习有其独特的数学基础,我们用微积分来处理变化无限小的函数,并计算 它们的变化;我们使用线性代数来处理计算过程;我们还用概率论与统计学建模不确定性。 在这其中,概率论有其独特的地位,模型的预测结果、学习过程、学习目标都可以通过概率的角度来理解。 与此同时,从更细的角度来说,随机变量的概率分布也是我们必须理解的内容。在这篇文章中,项目作者介绍了所有你需要了解 的统计分布,他还提供了每一种分布的实现代码。 项目地址:https://github.com/grayk

xff123456_的博客 4799

模式识别与机器学习(二):常用的概率分布(共轭分布等)

本系列是经典书籍《Pattern Recognition and Machine Learning》的读书笔记,正在研读中,欢迎交流讨论。

Arthur-Chen的专栏 2万+

模式识别与机器学习(Python实现):如何用MCMC产生任意的概率分布随机数?Python简单实现

欢迎大家来到安静到无声的《模式识别与人工智能(程序与算法)》,如果对所写内容感兴趣请看模式识别与人工智能(程序与算法)系列讲解 - 总目录,同时这也可以作为大家学习的参考。欢迎订阅,优惠价只需9.9元,请多多支持!

安静到无声 2万+

simplexes(单纯形)

在文中,单纯形CCC是一种特殊的多面体。它由k1k+1k1个点v0v1vkv0​v1​vk​​ 构成,并且这些点是仿射独立(affinely independent)的,这意味着这些点的差向量是线性独立的。仿射独立的意思是,给定的k1k+1k1个点v0v1vkv0​v1​vk​中,任何一个点都不能通过其余kkk个点的仿射组合得到。换句话说,这些点是处在不同方向上的,它们之间的相对位置不能由低维的空间来描述。仿射组合。

xy_optics的博客 2309

模式识别与机器学习笔记2018.8.21

贝叶斯定理 例子,我们要选择的盒子的颜色是一个随机变量,记作 B 。这个随机变量可以取两个值中的一个,即 r (对应红盒)或 b (对应蓝盒)。类似地,水果的种类也是一个随机变量,记作 F 。它可以取 a (苹果)或者 o (橘子) 如果在我们知道水果的种类之前,有人问我们哪个盒子被选中,那么我们能够得到的最多的信息就是概率 p(B) 。我们把这个叫做先验概率(prior probab...

cjj189492的博客 901

全面掌握模式识别与机器学习的圣经

本文还有配套的精品资源,点击获取 简介:《模式识别与机器学习》由Christopher Bishop所著,是机器学习领域的经典之作。它深入浅出地讲解了模式识别和机器学习的基本理论、方法和技术,是数据科学家和AI研究者的必读文献。书中详细阐述了统计和概率方法在数据分析中的应用,包括图像识别、语音识别和文本分类等。同时,介绍了监督学习、无监督学习和半监督学习的机器学习范式,以及...

weixin_42502040的博客 949

7月8日学习笔记——统计决策方法

本博文内容为的第二章前半部分学习笔记。1.本章介绍在。

mstcoder的博客 278

SimplexSampling:通过狄利克雷分布进行单工采样

单工采样 通过狄利克雷分布进行单工采样

开源!《模式识别与机器学习(PRML)》笔记、代码、NoteBooks 发布

微软剑桥研究院实验室主任 Christopher Bishop 的经典著作《Pattern Recognition and Machine Learning》,中文译名《模式识别与机器学...

红色石头的专栏 2117

模式识别课程-总结

1. Introduction 1.1 大纲 贝叶斯 SVM Unsupervised Learning & Clustering Algorithm-independent ML Application & Examples 1.2 PR ? 定义:输入原数据,提取它潜在的模式,并对模式做分类 目标:(1)对原数据去噪声;(2)建立若干model来近似描述数据背后对应的的真...

weixin_30797199的博客 2849

模式识别与机器学习第二章课件

国科大模式识别与机器学习第二章2018年课件,黄庆明老师主讲,第二章统计判别

机器学习笔记—模式识别与智能计算(一)模式识别概述

1、模式识别的基本概念 模式识别是信号处理与人工智能的重要分支,人工智能是专门研究用机器人模拟人的动作、感觉和思维过程与规律的科学,模式识别是利用计算机专门对物理量及其变化过程进行描述与分类。 模式是供模仿用的完美无缺的标本/样本,模式是通过对具体的个别事物进行观察所得到的具有时间和空间分布的信息,而模式类是指模式所属的类别或同一类别中模式的总体。 (1)模式的描述方法 测量空间:测量样本后获取的原始数据构成的空间 模式:样本...

firemonkeycs的专栏 4135

core_analyzer分析c++程序内存占用

环境:centos; 进程:单进程多线程c++程序; 问题:1. 分析系统内存占用; 2. 分析ptmalloc内存空洞(bins上的空闲chunk的大小); 包括:1. 占用了很大内存的c++进程; 2. gcore(在进程不core dump的情况下生成core文件); 3. core_analyzer(分析gcor...

weixin_41644391的博客 4043

模式识别与机器学习课程笔记(1):数学基础

本文介绍了模式识别与机器学习的数学基础,主要内容包括:1)特征矢量的三种类型(物理量、次序量、名义量)及其处理方法;2)随机矢量的概率分布描述,包括联合分布、条件分布和数字特征(均值、协方差等);3)随机变量间的统计关系(相关性、独立性);4)随机矢量的变换方法;5)正态分布的性质;6)离散随机变量的分布;7)信息论中的自信息概念。这些数学工具为后续的模式识别与机器学习算法提供了理论基础。

Grow into a more wonderful you 834

《模式识别与机器学习》 简称 PRML 开源了

前言 本文的原文连接是: https://blog.csdn.net/freewebsys/article/details/84847904 未经博主允许不得转载。 博主地址是:http://blog.csdn.net/freewebsys 1,关于PRML 《Pattern Recognition and Machine Learning》,中文译名《模式识别与机器学习》,简称 PRML。出...

freewebsys的专栏 1万+

PHP服务端 苹果支付(IAP)处理

公司做的app需要做IAP订阅支付,开始觉得和微信的支付流程差不多,做起来还是有点麻烦,主要是网上的文章很少,不能拿来主义。自己做完总结一下,希望对小伙伴们有帮助我就很欣慰了。代码写的不好 不要喷我。。。 首先讲一下我的业务逻辑,也就是php服务端需要做什么事情。 先上图: 下面我详细的讲一下每...

山水的博客 9598

PRML《模式识别与机器学习》的Python3代码实现

项目地址: Python实现:https://github.com/ctgk/PRML Matlab实现:https://github.com/PRML/PRMLT PRML是一本有关机器学习的入门必备书籍,与“西瓜书”齐名,目前豆瓣评分9.5分: 书籍评价 引用网友对PRML的评价: “个人认为这是机器学习领域必读的一本书,甚至是目前最好的书。但这本书太过于 Bayesian, 作者对任何...

土豆洋芋山药蛋的博客 2417

人工智能入门系列之一: 鸢尾花(Iris)多分类的神经网络详解及代码实现

这是最好的时代,我们一起来打造属于自动驾驶汽车上路、无人机飞天、智能机器人管工厂的AI未来 人工智能领域分化为两个阵营:其一是规则式(rule-based)方法,在人工智能早期占主峰;其二是神经网络(neural network)方法,后起之秀。随着硬件水平的提高,算力的指数式增长;人工智能的重心已经从规则式的专家时代转移到神经网络的数据时代。 “神经网络”不选择把人脑熟稔的逻辑规则传授给计算机...

NLP家的码奴小荷的博客 2万+

《模式识别和机器学习》摘要和关键问题

ML 和 MAPML: argmax(p , p(x | p)) 。其中x是样本。如果参数p先验等概,于是根据Bayesian定理ML和MAP等价。        ML的方差低估(bias):        对Gaussian的参数计算ML,得到方差为sML = 1/N * sum(i, xi - uML)2        展开计算可得E(sML) = (N-1)s / N,其中s

quanben 1577

经典教材《模式识别和机器学习》官方免费下载!

编辑:肖琴 【新智元导读】最经典的机器学习教材之一、大牛Christopher Bishop所著的《模式识别与机器学习》公开了官方的免费下载版本! 今天,微软剑桥研究院在官方推特放出一个大好消息:最经典的机器学习教材之一、Christopher Bishop所著的“Pattern Recognition and Machine Learning”(模式识别与机器学习)公开了官方的免费下载版...

ctrigger的专栏 2740

UE4 Instanced Mesh 半透明渲染顺序不对解决

以绿色方块为Instanced Mesh为例。 正确的半透应该是这样的: 这是一般蓝图Actor方块,其半透是正常的。 然而Instanced Mesh因为过多,UE4不给你缓存正确的渲染顺序。所以,在不改代码的情况下,想解决Instanced Mesh半透问题,是不可能的。不正确的半透如下: 注意到错误发生在Instanced Mesh的方块与方块之间。 但我就是要解决,...

qq_41524721的博客 4835
上一篇: 使用Jsoup抽取数据
下一篇: 深入异常处理
iteye_14216
博客等级 码龄8年 6粉丝 127原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

个

红包个数最小为10个

元

红包金额最低5元

当前余额3.43元 前往充值 >
需支付:10.00元
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付元
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值