OpenAI o1模型背后的核心人才?清北复旦华人立功

 Datawhale分享 

OpenAI o1模型,来源:新智元

【导读】OpenAI的「草莓」——o1系列模型,居然迅雷不及掩耳地上线了!在复杂推理、数学和代码问题上,它又提升到了全新高度,可以说打碎了我们对LLM固有水平的认知。这次由Ilya奠基的工作,产生了全新的Scaling Law。

OpenAI最强的o1系列模型上线。毫无预警地,OpenAI就扔出这一声炸雷。

传说中两周内就要上线的草莓模型,居然两天内就来了!

c53276d72714f82c555928c0b9beba65.png

从今天开始,o1-preview在ChatGPT中会向所有Plus和Team用户推出,并且在API中向tier 5开发者推出。

同时,OpenAI还发布了o1-mini——一种经济高效的推理模型,非常擅长STEM,尤其是数学和编码。

e00cfc49aee90f1c8b290851e523db2b.png

o1模型仍存在缺陷、局限性,它在首次使用时比长期使用,更令人印象深刻

全新的o1系列,在复杂推理上的性能又提升到了一个全新级别,可以说拥有了真正的通用推理能力。

在一系列基准测试中,o1相比GPT-4o再次有了巨大提升,具有了奥数金牌能力,在物理、生物、化学问题的基准测试中,直接超过了人类博士水平!

1ea3de468da78b79bc0437c4abb728b3.png

OpenAI研究员Jason Wei表示,o1-mini是自己过去一年看到的最令人惊讶的研究成果。一个小模型,居然在AIME数学竞赛中获得了高于60%的成绩。

cc64bda240370499334fed2752d3982a.png

不过,从OpenAI文章中的附录来看,这次放出的preview和mini似乎都只是o1的「阉割版」。

ae51e3bfba136463a683dbdef03f6318.png

幕后团队一览

推理研究

在奠基贡献者里,离职创业的Ilya Sutskever赫然在列,但并没有和Greg Brockman等人被列在执行管理(executive leadership)中,想必是他之前的研究工作为o1奠定了基础。

804075d07c1f07f7dfe018d8845628e5.png

Hongyu Ren

cd7d7d693797e878faa6b363a1686ea2.png

Hongyu Ren本科毕业于北大计算机科学专业,并在斯坦福获得了博士学位,从去年7月起加入OpenAI,此前曾在谷歌、苹果、英伟达、微软等公司有过工作经历。

Jason Wei

b68cc1481a92d692abf20a2014eafd96.png

Jason Wei目前任OpenAI研究员。他在2020-2023年期间,在谷歌大脑任职,提出了著名CoT、指令微调,并发表了大模型涌现能力的论文。

Kevin Yu

349c0b8741b435ebde31d488a782edf9.png

Kevin Yu现任OpenAI研究员。他曾在2014年和2021年分别获得了UC伯克利物理学和天体物理学硕士和神经学博士学位。

Shengjia Zhao

4321ad65b18668fa6f9e36119ba8d989.png

Shengjia Zhao本科毕业于清华大学,同样在斯坦福获得了博士学位,2022年6月毕业后就加入了OpenAI技术团队,他也是GPT-4的作者之一。

Wenda Zhou

8f81999de221b5114347e94138914afd.png

Wenda Zhou于去年加入OpenAI。此前,他曾在纽约大学数据科学中心实验室,是Moore-Sloan Fellow一员。

他在2015年获得了剑桥大学硕士学位,2020年取得了哥伦比亚大学统计学博士学位。

Francis Song

723ddd2d5665e3f739dc1b620124d1fa.png

Francis Song曾获得哈佛大学物理学学士学位,耶鲁大学物理学博士学位。他于2022年加入OpenAI,此前曾任DeepMind的研究科学家,纽约大学助理研究科学家。

Mark Chen

1401a5cc99b64093dfd9715be2ae2f29.png

Mark Chen从2018年起加入OpenAI时就开始担任前沿研究主管,在研究副总裁Bob McGrew领导下负责一个工作组。

从MIT毕业时,Chen获得了数学与计算机科学的双学士学位,大学期间曾在微软、Trading实习,并在哈佛大学做过访问学者。

目前,他还担任美国IOI集训队的教练。

此外,领导团队中还包括接任Ilya的首席科学家Jakub Pachocki和OpenAI仅存的几名联创之一Wojciech Zaremba。

推理技术安全

Jieqi Yu

e5e7bcf5c2f258c71ab0d2711c364a69.png

Jieqi Yu本科毕业于复旦大学电子工程专业,曾前往香港科技大学进行交换,之后在普林斯顿大学获得博士学位。她曾在Facebook工作了12年之久,从软件工程师转型为软件工程经理,并于去年8月加入OpenAI担任工程经理。

Kai Xiao

da1c842c59324c8deb6bbf1db1e6f80b.png

Xiao Kai本科和博士都毕业于MIT,本科时还拿到了数学和计算机科学的双学位,曾前往牛津大学进行学术访问,在DeepMind、微软等公司有过实习经历,于2022年9月加入OpenAI。

Lilian Weng

557efd69d514525dc018d8f948392d49.png

Lilian Weng现任OpenAI安全系统负责人,主要从事机器学习、深度学习等研究 。

她本科毕业于北京大学信息系统与计算机科学专业,曾前往香港大学进行短期交流,之后在印第安纳大学布鲁明顿(Indiana University Bloomington)分校获得博士学位。

和Mark Chen一样,Lilian也被认为是OpenAI领导层的后起之秀。

OpenAI还放出了o1模型背后团队的最新采访视频,接下来一睹为快:

团队完整名单如下:

703014910af06eef6ffb9560674adf1b.png

a096f09baa88ba14a94efd7df05ee201.png

参考资料:

https://openai.com/index/learning-to-reason-with-llms/

e8eae26817bee84e9ad98d493df0c19f.png一起“赞”三连

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值