摩尔线程 深度学习平台开发 一面

10月24日 35 分钟

  1. 自我介绍
  2. 实习经历
  3. 拷打细节
  4. 遇到过什么 bug
  5. 项目经历
  6. 接触过 LLVM 吗->写过 Pass吗->大致怎么实现一个 Pass
  7. CUDA
  8. GPU 架构懂吗(不大懂)
  9. pytorch 熟悉吗->pytorch 和 tensorfow 有什么区别不->自动微分怎么实现的(这个确实不知道)
  10. 你觉得深度学习本质是什么(找局部\全局最优解吧)->怎么找的->怎么保证不落入局部最优解
  11. 描述下训练一个模型的过程
  12. 矩阵学过吗->海森矩阵有什么用(不会) ->矩阵的秩
  13. c++和 python 哪个用的多(差不多)->那来点 c++
  14. static 的作用、原理
  15. 模板的原理
  16. 完美转发
  17. 手撕-交换单链表的两个节点
  18. 反问
  19. 业务
  20. pytorch 对接摩尔的 GPU的优化、落地之类的吧
  21. 结果
  22. 很快就出(我知道我过不了的)
全部评论
我擦,你都没过我有啥资格过
点赞 回复 分享
发布于 2024-12-03 11:52 广东
(不全面,但可行) 找多元函数的极值时,可以使用牛顿迭代法,搜索导函数(Jacobi向量)为0向量的点。 那么可以使用Jacobi向量乘Hessian矩阵的逆来预估每次的步长以及方向。
点赞 回复 分享
发布于 2024-11-17 23:22 上海

相关推荐

📍面试公司:小米🕐面试时间:2026/03/26(二十分钟草草收场,都不想去看结果就知道挂了)💻面试岗位:大模型推理优化❓面试问题:一、自我介绍二、八股问题拷打,其实上来就是手撕1、直接在编辑器上手撕MGA,要求写出init、forward、注意力层   ——丢人现眼了,基本不会写2、追问,不会写的话讲一下整个过程,输入到输出怎么样的?         ——讲了讲transformer,注意力机制3、vllm和sglang的底层代码有看过吗?                                          ——没看过(其实看过,但我不敢说,怕叫我写)4、kv cache有哪些加载方式?                                                        ——在胡言乱语,啊这个,啊那个5、PD分离机制是干什么的?你怎么实现的?                                   ——唯一能回答的问题6、有没有用vllm部署过模型?吞吐量是多少?                                 ——脑子昏了,沉默(跑了demo,没测过)7、MTP(可能是MCP?没听清)是什么,介绍一下?                     ——我估计想问Medusa?反正我没回答,沉默。到这他问不下去了。。。三、反问两个人尴尬一笑,没什么要问的了。🙌面试感想:应该是史上最无悬念的秒挂,第一个手撕不会之后我已经晕头转向了,加上昨天熬夜到五点,到后面我都有点不好意思了,感觉在浪费他的时间,在这里跟他道个歉😀。十月到现在算上开发+infra可能面了二十多家吧,大部分都是秒挂,感觉车企infra这块的要求都特别高吧,问的特别细,就是最新的技术一定都要掌握,这一块技术迭代感觉特别特别快,光背八股面经给我感觉不太行。鼠鼠也累了,但自觉已经尽力了。也感谢这些至少还给机会面试的公司吧,有些简历直接投垃圾桶里了。(希望下一届的同学早早准备,不要像鼠鼠一样还在为春招奔波)。
查看8道真题和解析
点赞 评论 收藏
分享
评论
5
14
分享

创作者周榜

更多
牛客网
牛客网在线编程
牛客网题解
牛客企业服务