算法题难是指numpy实现全连接难吗
点赞 1

相关推荐

大厂算法岗面试官帮你规划学习路线✴️今天给大家梳理一下:算法岗求职过程中关键的影响因素,希望能帮助同学们达到算法岗的要求。0️⃣学历:硕士以及以上。一般来讲,学校层次在985/QS前200尤佳。简历非常优秀的211/双非硕士也有机会。1️⃣初期准备:要有python和深度学习/机器学习基础,其中针对关键的模型(CNN/RNN/Transformer/VIT/Bert/GAN等),要熟悉原理以及能进行模型训练/测试。2️⃣方向选择:从目前热门的方向,比如大语言模型,多模态大模型,AIGC图像生成,搜广推中选择未来的发展方向,这些方向更容易拿到大厂算法offer。3️⃣简历:重点突出对口且有质量的项目经历,以及实习经历,这个是决定是否能够脱颖而出的关键。这一部分如果缺少,可以后台咨询补充经历。4️⃣面试能力:(1)体现在能否给面试官有逻辑的体现自己过往的经历,比如有质量的项目/实习经历。(2)对算法领域有足够的了解,更多体现在对新方法的跟进以及经典方法的理解。5️⃣代码:leetcode top 100分类别去刷,包括数组,链表,矩阵运算,动态规划等等,以及经典网络代码,比如MHSA,LN等。🍁如果想进一步了解如何规划学习路线,提升简历和面试能力,欢迎后台咨询。#简历中的项目经历要怎么写# #大模型# #互联网大厂招聘# #算法岗面试#
点赞 评论 收藏
分享
✅一面1️⃣深挖多模态论文2️⃣介绍transformer架构3️⃣详细说一下Decoder的因果注意力 QKV分别来自哪4️⃣Attention为什么要做scaled 不做会怎么样 为什么用根号d_k5️⃣Transformer怎么做加速训练(KV缓存) 训练和推理有什么区别(并行化)6️⃣深挖多模态大模型论文用的video-llama 讲一下大模型的结构7️⃣论文用了CoT讲一下论文的CoT是怎么样的8️⃣微调用的LoRA介绍一下LoRA9️⃣LoRA初始化怎么做的,用的秩是多少,为什么不选其他的数1️⃣0️⃣知道deepspeed和megatron吗?分别介绍一下1️⃣1️⃣论文用的deepspeed详细讲了一下三个stage分别是什么✅二面1️⃣深挖多模态和大模型的论文2️⃣Decoder文本生成有哪几种方法3️⃣还知道哪些多模态大模型4️⃣介绍一下ALBEF、BLIP5️⃣BLIP2的结构是什么  两阶段怎么训练的 有哪些损失6️⃣知道PEFT吗 讲一下LoRA7️⃣还有什么微调方法 -> prefix-tuning和P-tuning 两者分别是怎么做的 为了解决什么提出的8️⃣后面就是一些场景题✅三面1️⃣深挖论文2️⃣讲一下multi-head attention 用pytorch手撕一下 要可以实现cross attention的3️⃣讲一下你用的大模型是什么结构 特征是怎么喂给大模型的4️⃣大模型训练为什么不用SFT5️⃣LoRA是什么?有什么好处6️⃣知道RLHF吗?讲一下训练流程7️⃣接下来就是好几个场景题,电商相关的,用大模型解决prompt应该怎么设计,怎么处理prompt的输出,怎么过滤错误格式的输出📳对于想求职算法岗的同学,如果想参加高质量项目辅导,提升面试能力,欢迎后台联系。
字节跳动三面464人在聊 查看23道真题和解析
点赞 评论 收藏
分享
牛客网
牛客企业服务