机器学习-回归模型-欠拟合和过拟合

最新推荐文章于 2022-10-31 20:42:55 发布

catchupwith2

最新推荐文章于 2022-10-31 20:42:55 发布

阅读量881

点赞数

分类专栏：机器学习

机器学习专栏收录该内容

5 篇文章 1 订阅

订阅专栏

1. 什么是欠拟合和过拟合

先看三张图片，这三张图片是线性回归模型拟合的函数和训练集的关系

第一张图片拟合的函数和训练集误差较大，我们称这种情况为 欠拟合
第二张图片拟合的函数和训练集误差较小，我们称这种情况为 合适拟合
第三张图片拟合的函数完美的匹配训练集数据，我们称这种情况为 过拟合

类似的，对于逻辑回归同样也存在欠拟合和过拟合问题，如下三张图

2. 如何解决欠拟合和过拟合问题

欠拟合问题，根本的原因是特征维度过少，导致拟合的函数无法满足训练集，误差较大。

欠拟合问题可以通过增加特征维度来解决

过拟合问题，根本的原因则是特征维度过多，导致拟合的函数完美的经过训练集，但是对新数据的预测结果则较差。

解决过拟合问题，则有2个途径

减少特征维度; 可以人工选择保留的特征，或者模型选择算法
正则化; 保留所有的特征，通过降低参数θ的值，来影响模型

3. 正则化

回到前面过拟合例子, h(x) = θ0 + θ1x1 + θ2x2 + θ3x3 + θ4x4

从图中可以看出，解决这个过拟合问题可以通过消除特征x3和x4的影响, 我们称为对参数的惩罚, 也就是使得参数θ3, θ4接近于0。

最简单的方法是对代价函数进行改造，例如

这样在求解最小化代价函数的时候使得参数θ3, θ4接近于0。

正则化其实就是通过对参数θ的惩罚来影响整个模型

4. 线性回归使用正则化

前面几篇文章中，线性回归的代价函数J(θ)表达式如下

正则化后，代价函数J(θ)表达式如下，注意j从1开始

注意λ值不能设置过大，否则会导致求出的参数除了θ0，其它θ1,θ2 ... θn值约等于0，导致预测函数h(x)出现极大偏差

我们的目标依然是求J(θ)最小值，我们还是用梯度下降算法和正规方程求解最小化J(θ)

1. 梯度下降算法(注意需要区分θ0和其它参数的更新等式)

2. 正规方程

对于正规方程来，需要修改等式如下

系数λ 所乘的矩阵为 (n+1)*(n+1)维

5. 逻辑回归使用正则化

和线性回归模型类型，逻辑回归也可以通过正则化来解决过拟合问题。

逻辑回归的代价函数J(θ)表达式如下

正则化逻辑回归的代价函数，是在等式后加上一项，注意j从1开始

同样的用梯度下降算法求解最小化J(θ)，也需要做改变

不同的是逻辑回归模型中的预测函数 h(x)和线性回归不同

关注

0
点赞
踩
3

收藏

觉得还不错? 一键收藏
0
评论
机器学习-回归模型-欠拟合和过拟合

1. 什么是欠拟合和过拟合先看三张图片，这三张图片是线性回归模型拟合的函数和训练集的关系第一张图片拟合的函数和训练集误差较大，我们称这种情况为欠拟合第二张图片拟合的函数和训练集误差较小，我们称这种情况为合适拟合第三张图片拟合的函数完美的匹配训练集数据，我们称这种情况为过拟合类似的，对于逻辑回归同样也存在欠拟合和过拟合问题，如下三张图
复制链接

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。