PRML笔记

最新推荐文章于 2020-01-06 15:00:11 发布

李困困

最新推荐文章于 2020-01-06 15:00:11 发布

阅读量573

点赞数

分类专栏：机器学习

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/zhili8866/article/details/55053459

版权

机器学习专栏收录该内容

13 篇文章 0 订阅

订阅专栏

根均方误差（RMS）

E R M S = 2 E (w *) / N - - - - - - - - - \sqrt

$E_{RMS} = \sqrt {2E({w^*})/N}$

其中，除以 $N$ 让我们能够以相同的基础对比不同大小的数据集，平方根确保了 $E_{RMS}$ 与目标变量 $t$ 使用相同的规模和单位进行度量。

生成模型和判别模型

　　判别方法：由数据直接学习决策函数Y=f(X)或者条件概率分布P(Y|X)作为预测的模型，即判别模型。基本思想是有限样本条件下建立判别函数，不考虑样本的产生模型，直接研究预测模型。典型的判别模型包括k近邻，感知级，决策树，支持向量机等。
　　生成方法：由数据学习联合概率密度分布P(X,Y)，然后求出条件概率分布P(Y|X)作为预测的模型，即生成模型：P(Y|X)= P(X,Y)/ P(X)。典型的生成模型有：朴素贝叶斯和隐马尔科夫模型等。
　　生成算法尝试去找到底这个数据是怎么生成的（产生的），然后再对一个信号进行分类。基于你的生成假设，那么那个类别最有可能产生这个信号，这个信号就属于那个类别。判别模型不关心数据是怎么生成的，它只关心信号之间的差别，然后用差别来简单对给定的一个信号进行分类。

贝叶斯定理、似然函数

p (w | D) = p ( D | w ) p ( w ) p ( D )

$p(w|D)=\frac{p(D|w)p(w)}{p(D)}$
　　贝叶斯定理右侧变量

p(D|w) $p(D|w)$ 由观测数据集

D $D$ 来估计，可以看成是参数向量

w $w$ 的函数，被称为似然函数。它表达了在不同的参数向量

w $w$ 下，观测数据出现的可能性的大小。注意，似然函数不是

w $w$ 的概率分布，并且它关于

w $w$ 的积分并不（一定）等于1。
　　频率学家广泛使用的一个估计是最大似然（ maximum likelihood）估计，其中

w $w$ 的值是使似然函数

p(D|w) $p(D|w)$ 达到最⼤值的

w $w$ 值。这对应于选择使观察到的数据集出现概率最大的

w $w$ 的值。在机器学习的文献中，似然函数的负对数被叫做误差函数（ error function）。由于负对数是单调递减的函数，最大化似然函数等价于最小化误差函数。

高斯分布　　

　　

N (x | μ, σ 2) = 1 ( 2 π σ 2 ) 1 / 2 e x p {- 1 2 σ 2 (x - μ) 2}

$N(x|\mu,\sigma^2)=\frac{1}{(2\pi{\sigma}^2)^{1/2}}exp\{-\frac{1}{2\sigma^2}(x-\mu)^2\}$
　　

E [x] = μ; E [x 2] = μ 2 + σ 2; v a r [x] = σ 2

$E[x]=\mu;E[x^2]=\mu^2+\sigma^2;var[x]=\sigma^2$
　　反对法
　　监控

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。