微软发布Phi-4，最强小模型！参数极小、超GPT-4o

原创于 2025-01-11 20:19:02 发布 · 359 阅读

·

2

·

CC 4.0 BY-SA版权

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

文章标签：

（1）Phi-4（微软移动端大模型）
2024.12.18 微软研究院发布了最强小参数模型——Phi-4。
　　Phi系列模型自今已经发布了5代，Phi-4也延续了之前的小参数模式只有140亿。
　　但在GPQA研究生水平、MATH数学基准中，分别达到了56.1和80.4超过了GPT-4o，同时也超过了同类型的开源模型Qwen 2.5 -14B和Llama-3.3-70B。
　　而在美国数学竞赛AMC的测试中，Phi-4达到了惊人的91.8分，再次超过了GeminiPro 1.5、GPT-4o、Claude 3.5 Sonnet、Qwen 2.5等知名开闭源模型，甚至整体性能可以与4050亿参数的Llama-3.1相媲美。
　　Phi-4能以如此小的参数获得巨大性能，使用高质量合成训练数据是关键环节之一。
　　传统的大模型通常依赖于从网络抓取或公开数据库获取的真实世界文本作为训练数据，这种方法虽然能够提供丰富的信息来源，但也容易受到噪声干扰和偏见影响。
　　Phi-4则使用了种子策划、多Agent提示、自我修订工作流、重写和增强以及指令反转等多种合成方法，有效解决了传统无监督数据集的缺点。

参考博客：
微软发布Phi-4，最强小模型！参数极小、超GPT-4o
微软推出Phi-4大模型，擅长推理，超越Qwen 2.5

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。