机器学习为什么需要交叉验证？怎么使用k-fold cross validation（k-折叠交叉验证）

最新推荐文章于 2024-07-30 17:41:43 发布

程序员表哥鱼大

最新推荐文章于 2024-07-30 17:41:43 发布

阅读量7.8k

点赞数 4

分类专栏： Python 机器学习文章标签：机器学习 python

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/weixin_41060109/article/details/80878325

版权

交叉验证是评估模型泛化能力的重要方法，尤其是k-折交叉验证。它通过将数据集划分为k个子集，轮流作为测试集进行训练和验证，最终选择平均错误率最低的模型。本文介绍了k-折交叉验证的概念、步骤，并提供了代码使用案例，适用于分类问题。

摘要由CSDN通过智能技术生成

介绍这个非常重要的概念，希望在训练算法时能帮助各位。

概念和思维解读

叉验证的目的：在实际训练中，模型通常对训练数据好，但是对训练数据之外的数据拟合程度差。用于评价模型的泛化能力，从而进行模型选择。

交叉验证的基本思想：把在某种意义下将原始数据(dataset)进行分组,一部分做为训练集(train set),另一部分做为验证集(validation set or test set),首先用训练集对模型进行训练,再利用验证集来测试模型的泛化误差。另外，现实中数据总是有限的，为了对数据形成重用，从而提出k-折叠交叉验证。

对于个分类或回归问题，假设可选的模型为。k-折叠交叉验证就是将训练集的1/k作为测试集，每个模型训练k次，测试k次，错误率为k次的平均，最终选择平均率最小的模型Mi。

最低0.47元/天解锁文章

程序员表哥鱼大

关注

4
点赞
踩
30

收藏

觉得还不错? 一键收藏
0
评论
机器学习为什么需要交叉验证？怎么使用k-fold cross validation（k-折叠交叉验证）

介绍这个非常重要的概念，希望在训练算法时能帮助各位。概念和思维解读叉验证的目的：在实际训练中，模型通常对训练数据好，但是对训练数据之外的数据拟合程度差。用于评价模型的泛化能力，从而进行模型选择。交叉验证的基本思想：把在某种意义下将原始数据(dataset)进行分组,一部分做为训练集(train set),另一部分做为验证集(validation set or test set),首先用训练集对模型...
复制链接

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。