机器学习----训练、验证、测试的区别

最新推荐文章于 2023-11-20 11:47:04 发布

qq_29707567

最新推荐文章于 2023-11-20 11:47:04 发布

阅读量6.6k

点赞数 13

分类专栏：思考总结

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/qq_29707567/article/details/107893061

版权

思考总结专栏收录该内容

27 篇文章 1 订阅

订阅专栏

最近项目上遇到一些训练方面的测试，数据样本的不同，测试结果区别很大，准确率有时不高，网上查了下相关的帖子、做法，参考一下。

参考一：转自（https://www.cnblogs.com/morwing/p/12144476.html）

验证集 —— 是模型训练过程中单独留出的样本集，它可以用于调整模型的超参数和用于对模型的能力进行初步评估。

测试集 —— 用来评估模最终模型的泛化能力。但不能作为调参、选择特征等算法相关的选择的依据。

一个形象的比喻：

训练集-----------学生的课本；学生根据课本里的内容来掌握知识。

验证集-----------作业，通过作业可以知道不同学生学习情况、进步的速度快慢。

测试集-----------考试，考的题是平常都没有见过，考察学生举一反三的能力。

　　传统上，一般三者切分的比例是：6：2：2，验证集并不是必须的。

　　那么为什么要测试集呢？

　　　　a)训练集直接参与了模型调参的过程，显然不能用来反映模型真实的能力（防止课本死记硬背的学生拥有最好的成绩，即防止过拟合)。

　　　　b)验证集参与了人工调参(超参数)的过程，也不能用来最终评判一个模型（刷题库的学生不能算是学习好的学生）。

　　　　c)所以要通过最终的考试(测试集)来考察一个学(模)生(型)真正的能力（期末考试）。

　　但是仅凭一次考试就对模型的好坏进行评判显然是不合理的，所以就要使用交叉验证法。交叉验证法的作用就是尝试利用不同的训练集/验证集划分来对模型做多组不同的训练/验证，来应对单独测试结果过于片面以及训练数据不足的问题。（就像通过多次考试，才得知哪些学生是比较厉害的）

好文要顶关注我收藏该文

关注

13
点赞
踩
30

收藏

觉得还不错? 一键收藏
1
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

专栏目录

评论 1

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。