首页
题库
公司真题
专项练习
面试题库
在线编程
面试
面试经验
AI 模拟面试
简历
求职
学习
基础学习课
实战项目课
求职辅导课
专栏&文章
竞赛
我要招人
发布职位
发布职位、邀约牛人
更多企业解决方案
AI面试、笔试、校招、雇品
HR免费试用AI面试
最新面试提效必备
登录
/
注册
算法打工人阿旺
07-10 23:39
中山大学 算法工程师
发布于山东
关注
已关注
取消关注
淘天大模型实习面经
📳对于想求职算法岗的同学,如果想参加高质量项目辅导,提升面试能力,欢迎后台联系。
全部评论
推荐
最新
楼层
暂无评论,快来抢首评~
相关推荐
07-17 00:07
已编辑
阿里巴巴_大模型算法工程师
大模型面经 - 快手快 Star
面试经验分享
点赞
评论
收藏
分享
07-23 21:03
腾讯_HR
腾讯-混元大模型面经-华5硕
腾讯-混元大模型面经-华5硕部门与岗位:TEG - 混元大模型团队 - 大模型对齐一面自我介绍,过实习,讲论文,论文过的比较细,有说的笼统的地方面试官会实时进行询问交流了解哪些大模型,简要挑一两个介绍一下,当时说了 Qwen 和 DeepSeek,然后面试官又问了这两个有什么区别接着上一问,为什么大家都开始探索 MoE 架构,MoE 相比 Dense 有什么好处在之前实习的时候用 LoRA 微调过 Qwen,于是问了有没有全量微调过,有没有对比过两者的性能表现讲一下大模型训练和推理的流程,SFT 和 RLHF 的作用分别是什么在 RLHF 中,目前主流的强化学习算法有哪几个,写一下损失函数的表达式代码:22. 括号生成代码:多头自注意力一面问的八股还是比较多的,问的也比较细,而且还写了两道代码题,整个面试花的时间也比较多,大概一个半小时左右二面自我介绍,过实习和论文,面试官会一起进行探讨,包括工作的动机、贡献和结果,也会提一些问题和建议之前实习用 DeepSpeed 微调过 Qwen2-72B,于是面试官问了 ZeRO-1,ZeRO-2,ZeRO-3 三个模式的区别当时你用 DeepSpeed ZeRO-3 来微调 Qwen2-72B,每一张卡占用的显存大概是多少,估算一下为什么是占这么多的显存除了 DeepSpeed,还用过其他的什么优化方法吗我看你也用到了 LoRA,知道 LoRA 的原理吗,A 和 B 两个矩阵怎么初始化,有了解过其他的初始化方法吗对 RLHF 了解的多吗代码:3. 无重复字符的最长子串二面更多的是结合具体的工作来问的,从用到的东西来引出问题,问的也比较灵活。当然因为部门主要是做对齐的,所以也大概聊了聊 RLHF三面自我介绍,挑一个觉得做的比较好的论文和实习讲一下,面试官问的比较详细,为什么选现在这种方案,为什么 work,其他方案有考虑吗在微调 Qwen 的时候,数据是怎么构造的,有用到什么数据清洗方法吗,数据配比是怎么做的讲一下 RLHF 的流程,之前有用 RLHF 做过模型对齐吗在做对齐的时候,为什么 SFT 之后还要做 RLHF,只用 SFT 可以吗知道哪些强化学习算法,除了 PPO 和 DPO 这些呢,DeepSeek 用的 GRPO 相比于 GPT 的 PPO 做了哪些改进开放题:对目前大模型的发展有什么看法代码:零钱的两个题 322. 零钱兑换518. 零钱兑换 II三面面试官更聚焦于对齐这一块的内容,考的比较深。由于之前没有接触过强化学习,答得还是比较吃力的,不过面试官还挺好的,会一起讨论来做引导四面自我介绍,过论文和实习,问的也比较细,这里能明显的感受出来面试官的视角更系统,会把这些工作串起来问我看你简历上没写 RLHF,平常有用过 RLHF 吗推导一下神经网络反向传播的过程一道排列组合的概率题开放题:你觉得大模型目前还有哪些可以改进的点四面整体更看重思维和基础,没有考察什么八股总结一共四轮技术面,整体来说强度比较大,对于大模型八股的考察比较细,对大模型的理解问的也比较深刻,包括一些数理逻辑基础,考察的比较全面腾讯-混元大模型面经-华5硕-主页内tui腾讯2026校园招聘技术研发提前批专项,报名启动面向对象:毕业时间在2025.1.1~2026.12.31期间的同学开放岗位:前端、移动端、PC端、游戏端、测试开发、技术运营等招聘项目选择:【人才专项-技术研发提前批】,截止时间:8月5日。技术研发提前批专项面试未通过,不影响后续参加常规应届生招聘。专项优势:-更大几率发起面试,投递即进专项简历库-更快流程推进,先人一步拿到正式offer-更高offer成功率,大前端、测试开发等热招岗位需求多多内推链接:https://join.qq.com/resume.html?k=ANQI6RfQ3rhPS2dpyIkeSw(内推简历优先筛选,加速流程推进)
帮你内推|腾讯 校招
点赞
评论
收藏
分享
06-29 21:35
中山大学 算法工程师
字节大模型面经复盘:
1️⃣自我介绍:【⌚️10分钟】点评:流水账,有些磕磕绊绊,自我介绍环节的项目介绍的很详细,非常冗余。优化:写逐字稿,背诵,提升语言表达能力。2️⃣经常问题的问题优化:【⌚️20分钟】1:transform结构了解吗?回答点评:回答的很简单,5分吧,说了transform的结构是encode-decode结构,分块,每个块里面有四个组建,MHA、FFN、LN、残差链接,介绍和理解不深刻。提升指导:梳理回答逻辑结构,讲解MHA、FFN、LN、残差链接的添加逻辑和含义,其中MHA给出代码层面理解,从2分钟的回答变成6分钟的回答。2:多头自注意力机制是啥?公式是啥?代码你会写吗?回答点评:讲了公式,但是掌握的不够细致,pytorch代码框架不熟悉,attention_mask机制没有写出来。提升指导:讲述代码的原理,如何使用代码回答问题,展示自己的理解深刻。3:rag中的多路召回是什么?embeding为啥用智源的BGE-large/Base?回答点评:使用了BM25和向量召回,但是没有讲出来两个的区别和联系提升指导:先讲原理,再讲述下语义理解能力和泛化能力的区别,计算的效率,两个互为补充等。3️⃣不会回答的问题指导:【⌚️40分钟】1: LN不太会回答,看网上的回答很多,但是不是理解层面。2:我的向量召回是faiss做的,和这个相关的问题我如何准备?3:经常会被问到rag用的啥框架,这个问题如何回答?还需要准备框架的知识吗?4:面试官经常问我,rag的模型是啥?有做微调吗?如果不做微调怎么回答?5:大模型还需要补充那些知识?📳对于想求职算法岗的同学,如果想参加高质量项目辅导,提升面试能力,欢迎后台联系。
查看8道真题和解析
点赞
评论
收藏
分享
07-16 14:35
电子科技大学 C++
快star大模型架构面经
一面:介绍实习30分钟左右 然后手撕一个k个一组二面:介绍实习 然后写课程表2 (leetcode原题)===========求一个三面
查看3道真题和解析
点赞
评论
收藏
分享
07-17 22:36
中山大学 算法工程师
抖音大模型|社招3轮面经
1️⃣抖音一面1、聊项目。2、AUC的两种公式是?你能证明这两种等价的吗?3、BERT-CRF中,为什么要加CRF?好处是?4、self-attention为什么要用QKV三个矩阵,不用有什么问题?有没有哪个模型的Q和K矩阵是一样的?5、reinforce属于on-policy还是off-policy?为什么?6、reinforce带上baseline好处是?reinforce的loss写一下?7、策略梯度会推导吗?简单写一下?8、代码题(代码题一般别着急写,先跟面试官说下思路,确定了再写):lc 46,全排列(lc表示leetcode,下同)。lc 73,矩阵置0。2️⃣抖音二面1、介绍项目。2、知识蒸馏有哪几种?你觉得哪种效果最好?3、nlp的数据增强方法,主要有哪几种?每一种举个例子?4、分类的损失函数为什么是交叉熵而不是mse?5、BERT对输入文本的长度有什么限制,为什么要限制长度呢?6、BigBird里面有哪几种注意力机制?相比原始transformer的self-attention的优势?7、场景题:如何根据拼多多的商品数量,估计淘宝的商品数量?8、给出emb_size, max_len, vocab_size, ff_inner_size,num_heads, 12层,求BERT参数量。9、代码题:n皇后问题。3️⃣抖音三面1、简单聊项目。2、CRF和HMM区别?CRF为什么比HMM效果好?3、如果BERT词表很大,比如vocab_size达到几百万,怎么办?4、快速手写一些transformer的mha(多头注意力),伪代码意思一下就行。5、为什么对比学习中,temperature很小,而知识蒸馏的temperature比较大?6、你觉得在抖音买东西,和淘宝、拼多多他们的区别是?(我没在抖音买过,就只能现场编。)7、你最近看到过哪些paper?简单介绍下?8、你觉得自己有那些优缺点?平时喜欢怎么缓解压力?📳对于想求职算法岗的同学,如果想参加高质量项目辅导,提升面试能力,欢迎后台联系。
查看26道真题和解析
点赞
评论
收藏
分享
一键发评
mark
已老实
忍耐王
收藏
算法岗项目辅导
评论
点赞成功,聊一聊 >
点赞
4
分享
评论
提到的真题
返回内容
全站热榜
更多
1
...
25年秋招精心整理的最新互联网大厂笔面试题集合
2.0W
2
...
暑期实习转正自评,你就这么写!
8104
3
...
字节秋招-后端开发-一面
7181
4
...
26秋招-拓竹嵌入式软件面经
4807
5
...
本华为OD终于翻身!(百度后端面经)
4601
6
...
26届秋招建议
2826
7
...
影石嵌入式驱动开发面经
2781
8
...
字节秋招意向
2676
9
...
亚信科技java实习面经
2626
10
...
打工人基本微信沟通礼仪
2257
创作者周榜
更多
正在热议
更多
#
实习的内耗时刻
#
13819次浏览
198人参与
#
独居后,你的生活是更好了还是更差了?
#
4747次浏览
79人参与
#
去哪儿旅行秋招
#
222624次浏览
3168人参与
#
我的秋招“寄”录
#
10256次浏览
131人参与
#
规定下班时间vs实际下班时间
#
9171次浏览
68人参与
#
你上一次给父母打电话是什么时候
#
6333次浏览
69人参与
#
腾讯大前端岗位热招中
#
14428次浏览
156人参与
#
工作上你捅过哪些篓子?
#
6852次浏览
46人参与
#
得物求职进展汇总
#
103653次浏览
830人参与
#
你最近一次加班是什么时候?
#
72209次浏览
360人参与
#
秋招想进国企该如何准备
#
81104次浏览
441人参与
#
央国企投递记录
#
99274次浏览
1412人参与
#
入职第二天,午饭怎么解决
#
26470次浏览
76人参与
#
秋招笔面试记录
#
109088次浏览
2091人参与
#
美团秋招笔试
#
65423次浏览
412人参与
#
你们公司哪个部门最累?
#
29882次浏览
214人参与
#
奇葩时刻大赏
#
56971次浏览
237人参与
#
每个月的工资都是怎么分配的?
#
58817次浏览
584人参与
#
机械实习一天多少钱合适?
#
31630次浏览
183人参与
#
你认为工作的意义是什么
#
165412次浏览
1076人参与
#
面试被问期望薪资时该如何回答
#
267594次浏览
1531人参与
#
找工作有哪些冷知识
#
137880次浏览
2337人参与
牛客网
牛客网在线编程
牛客网题解
牛客企业服务