欠拟合与过拟合

最新推荐文章于 2024-01-08 15:30:44 发布

Hubz131

最新推荐文章于 2024-01-08 15:30:44 发布

阅读量420

点赞数

文章标签：机器学习算法

机器学习专栏收录该内容

12 篇文章 0 订阅

订阅专栏

在用机器学习搭建模型时，经常会碰到这样一种情况，你的模型算法在样本数据中匹配的非常完美。但用新数据测试，发现模型结果和实际差距非常大。那么恭喜你！你掉进了机器学习中常见的一个大坑——过拟合。

什么是过拟合呢？机器学习本质上是通过建立数据模型，使其和现有数据相吻合，从而找到数据中内在的规律。如下面三张图，x表示训练样本数据，蓝色线条表示建立的数据模型。

机器学习的“坑”——过拟合（overfitting）

第一张图：虽然模型部分体现了数据变化的趋势，但是样本数据基本都不在模型曲线上，这叫做欠拟合

第二张图：大多数的样本数据都在模型曲线上，平且很好的体现了数据变化规律，这叫做拟合

第三张图：虽然所有点都在模型曲线上，但却没有体现出数据变化规律，这就是过拟合

过拟合产生的原因是由于采集的样本本身带有的‘抽样误差“，而机器学习的算法可以产生足够复杂的模型，将这些误差值也精确拟合到模型中，导致生成的模型反倒丢失了的本质规律。说白了就是想太多了。

过拟合是在机器学习中经常会遇到的问题，不过不用怕。一般可以通过增加样本数量，或者减少模型复杂度的方式来规避这个坑。

文章来自（http://blog.csdn.net/u013043346/article/details/71723946?locationNum=7&fps=1）

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
欠拟合与过拟合

在用机器学习搭建模型时，经常会碰到这样一种情况，你的模型算法在样本数据中匹配的非常完美。但用新数据测试，发现模型结果和实际差距非常大。那么恭喜你！你掉进了机器学习中常见的一个大坑——过拟合。什么是过拟合呢？机器学习本质上是通过建立数据模型，使其和现有数据相吻合，从而找到数据中内在的规律。如下面三张图，x表示训练样本数据，蓝色线条表示建立的数据模型。第一张图：虽然模型部分
复制链接

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。