11.17阿里夸克大模型算法一面

一面
1.项目介绍
2.讲讲你对 transformer 的了解
3.有哪些常用的解码策略,topp 和 topk 的具体细节,以及实现上的差别
4.意图分流的 agent 怎么做微调的,用了多少数据
5.如何做 embedding 微调的,如何构造正负样例,训练的 loss 是什么
6.RAG有哪些可优化的地方
7. 你的 RAG 项目中用到了 agent 吗,一般 agent 会用在RAG 链路中的哪些部分
8.做 sft 时是怎么做数据配比的,参数具体怎么设置的
9.RLHF的流程,有没有训过 PPO
10.deepseed 的原理,zero1,2,3怎么做的
11.了解过排序模型吗,讲几个经典的排序模型吧
12.说-下 vm 部署8*7B的 MOE 模型每秒大概能推多少token
13.对比学习了解吗,讲一下
14.代码题:实现rand5到rand7
全部评论
你好想请问下大模型面试题怎么找啊
点赞 回复 分享
发布于 昨天 20:25 北京

相关推荐

1.实习介绍2. Lora 原理(核心是低秩分解:将原始权重更新近似为两个低秩矩阵乘积,减少参数量,保留主导方向,训练高效)3.了解 DeepSpeed 吗,ZeRO -1, ZeRO -2和 ZeRO3分别做了哪些优化(1优化优化器状态,2优化梯度,3切分参数,全面节省显存)4. Qwen的模型结构是怎么样的,相比于 LLaMA,DeepSeek 有什么区别(Qwen采用GQA+SwiGLU+RMSNorm,和LLaMA架构非常相似,差异在训练数据和tokenizer中文支持更好;DeepSeek只用MoE/MLA架构,Qwen系列主要是Dense模型)5.怎么缓解大模型的幻觉问题(RAG,RLHF对齐,事实监督)6.大模型的 MoE 结构相比于 Dense 结构训练的难点在什么地方,DeepSeekMoE为什么效果好,有什么值得我们借鉴创新点(MoE面临负载不均衡、训练不稳定问题;DeepSeekMoE通过细粒度专家和共享专家设计提升稳定性和效果)7.知道FP16和BF16有什么区别吗,包括FP32和INT8这些,在训练大模型的时候,应该怎么选择(FP16精度高但易溢出,BF16动态范围大;训练常用BF16混合精度,推理用INT8量化加速)8.讲-下 RLHF 的流程,写-下 PPO和 DPO的 Loss表达式(训练奖励模型后用PPO/DPO优化策略:PPO Loss: policy ratio + KL 约束/ DPO Loss: logit preference diff + sigmoid binary loss)9.对于超长上下文业界一般是怎么做的,你知道 Qwen是怎么做的吗(业界常用ROPE 变体/滑动窗口注意力/稀疏注意力等:Qwen使用YaRN和窗口注意力扩展上下文)10.开放题:你觉得目前大模型的上限在哪里(推理能力、长期记忆、具身交互和能耗效率,需要架构创新和多模态融合突破)11.代码:152.乘积最大子数组
查看9道真题和解析
点赞 评论 收藏
分享
1. 实习介绍2. 介绍一下项目及基础架构3. 项目拷打(大约20分钟、围绕简历提问)4. 性能优化怎么做的(大约20分钟)性能优化会从性能指标到阶段分析到优化细问5. JSBridge和客户端底层怎么进行通信的6. Ts的keyof、tyoeof、泛型、装饰器;ts在前端工程化有什么作用呢7. JS基础数据类型、通过哪些方法可以判断一个变量是数组类型?(问了5种方法)8. 做移动端的时候怎么保证视觉的还原度9. 如果视觉走查的某个视觉问题反复调整都无法完美还原怎么解决10. AI视觉稿转代码详细说说11. 为什么移动端上图片会展示模糊呢?12. DRP对图片渲染模糊有什么关联13. 移动端的动画选型和动画类型14. 有没有自己使用过canvas做一些绘制或动画渲染呢?15. js驱动的动画遇到卡顿怎么优化和处理呢16. 重绘重排在渲染层为什么会有不同的性能影响17. React的常用hooks;18. React对比直接使用js有什么提升?19. React18之前的版本对比React18有什么不同20. 服务端渲染ssr、rsc与csr的对比;水合失败会怎样21. http 0.9, http 1.0 ,http 1.1, http2,http3的区别,队头阻塞在各个阶段的问题和解决方案22. TCP vs UDP,介绍一下TCP的慢启动,强缓存+协商缓存23. csrf xss24. 加密方式了解哪些,介绍一下对称加密,非对称加密25. 日常怎么使用AI的,在工作中有哪些提效26. 两道题26.1. 手写数组的flat方法26.2. 手写一个PromiseAll,写完后顺便问了Promise的其他方法
查看27道真题和解析
点赞 评论 收藏
分享
评论
点赞
4
分享

创作者周榜

更多
牛客网
牛客网在线编程
牛客网题解
牛客企业服务