大模型面经 - 腾讯混元

程序员一粟

于 2025-05-06 17:27:22 发布

阅读量359

点赞数 10

文章标签： redis 数据库缓存人工智能 java 开发语言深度学习

本文链接：https://blog.csdn.net/jennycisp/article/details/147743951

版权

部门与岗位：TEG - 大模型对齐

一面

自我介绍，过实习，讲论文，论文过的比较细，有说的笼统的地方面试官会实时进行询问交流
了解哪些大模型，简要挑一两个介绍一下，当时说了 Qwen 和 DeepSeek，然后面试官又问了这两个有什么区别
接着上一问，为什么大家都开始探索 MoE 架构，MoE 相比 Dense 有什么好处
在之前实习的时候用 LoRA 微调过 Qwen，于是问了有没有全量微调过，有没有对比过两者的性能表现
讲一下大模型训练和推理的流程，SFT 和 RLHF 的作用分别是什么
在 RLHF 中，目前主流的强化学习算法有哪几个，写一下损失函数的表达式
代码：22. 括号生成
代码：多头自注意力

一面问的八股还是比较多的，问的也比较细，而且还写了两道代码题，整个面试花的时间也比较多，大概一个半小时左右

二面

自我介绍，过实习和论文，面试官会一起进行探讨，包括工作的动机、贡献和结果，也会提一些问题和建议
之前实习用 DeepSpeed 微调过 Qwen2-72B，于是面试官问了 ZeRO-1，ZeRO-2，ZeRO-3 三个模式的区别
当时你用 DeepSpeed ZeRO-3 来微调 Qwen2-72B，每一张卡占用的显存大概是多少，估算一下为什么是占这么多的显存
除了 DeepSpeed，还用过其他的什么优化方法吗
我看你也用到了 LoRA，知道 LoRA 的原理吗，A 和 B 两个矩阵怎么初始化，有了解过其他的初始化方法吗
对 RLHF 了解的多吗
代码：3. 无重复字符的最长子串

二面更多的是结合具体的工作来问的，从用到的东西来引出问题，问的也比较灵活。当然因为部门主要是做对齐的，所以也大概聊了聊 RLHF

三面

自我介绍，挑一个觉得做的比较好的论文和实习讲一下，面试官问的比较详细，为什么选现在这种方案，为什么 work，其他方案有考虑吗
在微调 Qwen 的时候，数据是怎么构造的，有用到什么数据清洗方法吗，数据配比是怎么做的
讲一下 RLHF 的流程，之前有用 RLHF 做过模型对齐吗
在做对齐的时候，为什么 SFT 之后还要做 RLHF，只用 SFT 可以吗
知道哪些强化学习算法，除了 PPO 和 DPO 这些呢，DeepSeek 用的 GRPO 相比于 GPT 的 PPO 做了哪些改进
开放题：对目前大模型的发展有什么看法
代码：零钱的两个题 322. 零钱兑换 518. 零钱兑换 II

三面面试官更聚焦于对齐这一块的内容，考的比较深。由于之前没有接触过强化学习，答得还是比较吃力的，不过面试官还挺好的，会一起讨论来做引导

四面

自我介绍，过论文和实习，问的也比较细，这里能明显的感受出来面试官的视角更系统，会把这些工作串起来问
我看你简历上没写 RLHF，平常有用过 RLHF 吗
推导一下神经网络反向传播的过程
一道排列组合的概率题
开放题：你觉得大模型目前还有哪些可以改进的点

四面整体更看重思维和基础，没有考察什么八股

总结

型目前还有哪些可以改进的点

四面整体更看重思维和基础，没有考察什么八股

总结

一共四轮技术面，整体来说强度比较大，对于大模型八股的考察比较细，对大模型的理解问的也比较深刻，包括一些数理逻辑基础，考察的比较全面

大模型岗位需求

大模型时代，企业对人才的需求变了，AIGC相关岗位人才难求，薪资持续走高，AI运营薪资平均值约18457元，AI工程师薪资平均值约37336元，大模型算法薪资平均值约39607元。
在这里插入图片描述

掌握大模型技术你还能拥有更多可能性：

• 成为一名全栈大模型工程师，包括Prompt，LangChain，LoRA等技术开发、运营、产品等方向全栈工程；

• 能够拥有模型二次训练和微调能力，带领大家完成智能对话、文生图等热门应用；

• 薪资上浮10%-20%，覆盖更多高薪岗位，这是一个高需求、高待遇的热门方向和领域；

• 更优质的项目可以为未来创新创业提供基石。

可能大家都想学习AI大模型技术，也想通过这项技能真正达到升职加薪，就业或是副业的目的，但是不知道该如何开始学习，因为网上的资料太多太杂乱了，如果不能系统的学习就相当于是白学。为了让大家少走弯路，少碰壁，这里我直接把全套AI技术和大模型入门资料、操作变现玩法都打包整理好，希望能够真正帮助到大家。

读者福利：如果大家对大模型感兴趣，这套大模型学习资料一定对你有用