GPT-4o mini登顶大模型竞技场，奥特曼：两个月内微调免费

知世不是芝士

于 2024-07-28 10:45:00 发布

阅读量114

点赞数 2

文章标签：人工智能深度学习 ai大模型大语言模型 prompt GPT-4o mini 计算机技术

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/python122_/article/details/140731569

版权

刚刚，GPT-4o mini版迎来“高光时刻”——

登顶了lmsys大模型竞技场，和满血版并列第一，还把Claude 3.5甩在了身后。

不同于一般的数据集测评，大模型竞技场是用户自己出题、用脚投票的结果，无法通过“刷题”来走捷径，因此更为真实。

这个成绩一出，连CEO奥特曼都激动起来了：

面对评估成绩，我们本来是尽量矜持的，但是看到GPT-4o mini表现和满血版一样，价格却只有1/20，内心还是很激动。

网友看到之后表示OK，但更关心的还是GPT-4o发布会上演示的“Her”到底啥时候上线。

与此同时，OpenAI也送来了另一个好消息，将为开发者送出福利——

GPT-4o mini的微调将逐步开放，目前已开放给tier 4和tier 5用户，然后会陆续扩展范围。

而且从即日起到9月23号，每天都能免费使用2百万的训练token。

mini与满血版平起平坐

经过80多款模型上百万轮的1v1比拼，GPT-4o mini在lmsys榜单上的成绩与满血版只差7分。

按照lmsys榜单的排法，这7分的差距没有影响名次，把两个型号算作了并列第一。

紧随其后的是Claude 3.5和Gemini家族，还有GPT-4的另外两个版本。

如果我们查看GPT-4o mini的原始数据，会发现它0.6的平均胜率仅次于满血版本。

单独看两者比拼的结果，同样是打得不相上下。

之所以lmsys的成绩受到关注，在于它拥有一套独特的比拼方式——

不用数据集，而是让用户自己出题，随机拉两个模型1对1battle，然后选择哪个模型表现更好。

在给出选择之前，模型是匿名的，用户也不知道是哪两个模型正在比拼，如果模型自己说漏嘴则投票无效。

这样得到的分数更加真实，既避免了“刷题”获取虚高分数的可能，也更加接近用户体验。

这个大模型竞技场，最近还登上了机器学习顶会ICML2024。

而且，lmsys的评测也非常受OpenAI的青睐，GPT-4o mini正式上线之前的早期版本，就曾化名为gpt-mini在其中打榜。

当时就已经排行第4，和GPT4-Turbo处在同一水平。

更早一些，GPT-4o上线之前也是化名gpt2-chatbot，在lmsys上搞起了测试。

不过也有人提出质疑，表示虽然GPT-4o mini表现确实很好，但是要说它超过了Claude 3.5 sonnet就有些言过其实了。

有人更是直言，lmsys方法的完善性已经开始瓦解，需要做出改变，否则将不再是一个有用的测试基准。

“小模型”也卷起来了

mini版本的推出，主打的就是一个性价比。

每百万输入/输出tokens，价格分别为15美分和60美分（约1.09/4.36人民币），甚至还不到3.5 Turbo的一半。

如果和两年前GPT-3的text-davinci-003版（当时最好的模型）相比，价格更是下降了99%。

而且除了把小模型开放给用户，OpenAI还搞出了新鲜玩法——

在“超级对齐”团队的一篇遗作中，使用了参数量为大模型千分之一或百分之一的小模型，来对大模型进行优化。

实验中，大小两个模型相互“博弈”，大模型需要不断优化调整自己的输出，让小模型相信自己说的是真话。

在这个“博弈”的过程中，大模型的能力得到了提升，在精度没有明显损失的情况下获得了大幅度的可理解性提升。

除了OpenAI，其他公司也都纷纷搞起了小模型。

比如在GPT-4o mini之前，谷歌和Anthropic就分别推出了Gemini Flash和Claude 3-Haiku。

甚至可以说，GPT-4o mini就是OpenAI对两家的反击，无论是性能还是价格都超越了这两个模型。

在GPT-4o mini发布的同一周，抱抱脸Hugging Face，以及“欧洲OpenAI”Mistral都相继推出了小号模型。

甚至苹果也推出了自己的7B模型，而且一次性开源了全部训练过程和资源。

总之，在性能足以满足使用需求的前提下，小模型无疑是一种更经济实惠的选择。

同时，更小的规模也意味着有可能在端侧运行，在隐私保护等方面显现出优势。

这样就不难理解，“小”模型为什么也越来越卷了。

参考链接：
[1]https://x.com/sama/status/1815877987696533897/
[2]https://x.com/OpenAIDevs/status/1815836887631946015

如何学习大模型

现在社会上大模型越来越普及了，已经有很多人都想往这里面扎，但是却找不到适合的方法去学习。

作为一名资深码农，初入大模型时也吃了很多亏，踩了无数坑。现在我想把我的经验和知识分享给你们，帮助你们学习AI大模型，能够解决你们学习中的困难。

我已将重要的AI大模型资料包括市面上AI大模型各大白皮书、AGI大模型系统学习路线、AI大模型视频教程、实战学习，等录播视频免费分享出来，需要的小伙伴可以扫取。

一、AGI大模型系统学习路线

很多人学习大模型的时候没有方向，东学一点西学一点，像只无头苍蝇乱撞，我下面分享的这个学习路线希望能够帮助到你们学习AI大模型。

在这里插入图片描述

二、AI大模型视频教程

在这里插入图片描述

三、AI大模型各大学习书籍

在这里插入图片描述

四、AI大模型各大场景实战案例

在这里插入图片描述

五、结束语

学习AI大模型是当前科技发展的趋势，它不仅能够为我们提供更多的机会和挑战，还能够让我们更好地理解和应用人工智能技术。通过学习AI大模型，我们可以深入了解深度学习、神经网络等核心概念，并将其应用于自然语言处理、计算机视觉、语音识别等领域。同时，掌握AI大模型还能够为我们的职业发展增添竞争力，成为未来技术领域的领导者。

再者，学习AI大模型也能为我们自己创造更多的价值，提供更多的岗位以及副业创收，让自己的生活更上一层楼。

因此，学习AI大模型是一项有前景且值得投入的时间和精力的重要选择。

知世不是芝士

关注

2
点赞
踩
4

收藏

觉得还不错? 一键收藏
0
评论
GPT-4o mini登顶大模型竞技场，奥特曼：两个月内微调免费

刚刚，GPT-4o mini版迎来“高光时刻”——，和满血版并列第一，还把Claude 3.5甩在了身后。不同于一般的数据集测评，大模型竞技场是用户自己出题、用脚投票的结果，无法通过“刷题”来走捷径，因此更为真实。这个成绩一出，连CEO奥特曼都激动起来了：面对评估成绩，我们本来是尽量矜持的，但是看到GPT-4o mini表现和满血版一样，价格却只有1/20，内心还是很激动。网友看到之后表示OK，但更关心的还是GPT-4o发布会上演示的“Her”到底啥时候上线。
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。