哈哈哈哈哈哈哈那是

昨天 18:23 已编辑发布于浙江

关注

阿里大模型算法工程师的一天

全部评论

推荐最新楼层

03-18 11:15

门头沟学院推荐算法

字节AI大模型算法二面

多模态模型横向对比除了 Video-LLaMA，还了解哪些主流多模态大模型？→ 常见的有 LLaVA、Flamingo、BLIP、BLIP-2、KOSMOS、PaLI 等简单介绍 ALBEF 和 BLIP 这两个模型的核心设计→ ALBEF：基于图像 - 文本对比学习，搭配动量蒸馏来优化图文对齐效果；BLIP：引入 captioner 生成高质量图文对，再结合 filter 机制筛选优质数据BLIP-2 的整体结构是什么？两阶段训练流程是怎样的？用到了哪些损失函数？→ 结构：在 ViT 和大语言模型之间插入 Q-Former 作为中间桥梁→ Stage1：冻结 ViT 和语言模型，只训练中间的 Q-Former→ Stage2：冻结语言模型，将 Q-Former 与 LM 连接，做指令微调→ 损失：ITC（图文对比损失）+ ITM（图文匹配损失）+ LM 生成损失微调方法（PEFT 全家桶）了解 PEFT 吗？再讲讲 LoRA，重点说明低秩假设的合理性→ PEFT 是参数高效微调的统称，核心是只训练少量参数而不动原模型权重；LoRA 假设模型权重更新量 ΔW 具有低秩特性，将其分解为 A×B，只训练 A、B 两个低秩矩阵，既节省显存又能保留效果除了 LoRA，还有哪些 PEFT 方法？Prefix-tuning 和 P-tuning 有什么区别？→ 其他方法：Adapter Tuning、Prefix-tuning、P-tuning、IA³ 等→ Prefix-tuning：在输入序列前加可学习的 prefix，作用于注意力的 K/V 矩阵，更适合 decoder-only 架构→ P-tuning：用小型网络（如 LSTM）生成连续的 soft prompt，解决离散 prompt 不稳定的问题，更适配 encoder-decoder 模型大模型训练范式你项目中用到的大模型结构是什么？多模态特征是如何喂给大模型的？→ 示例流程：视频帧 → TimeSformer 提取时空特征 → 特征池化 → 线性投影对齐到文本维度 → 拼接到文本 prompt 之前 → 输入 LLM大模型在做了指令微调后，为什么还需要 RLHF？→ 指令微调只是让模型学会遵循指令，但输出可能更偏向 “模板化”；RLHF 是通过人类偏好对齐，让模型输出更符合人类价值观、更自然、更有用的回答，解决 “有用性” 和 “安全性” 问题了解 RLHF 吗？描述它的完整训练流程→ 三阶段流程：① SFT 微调：用高质量指令数据对预训练模型做监督微调，让模型学会基本指令遵循② 训练 Reward Model（RM）：用人类标注的偏好数据训练奖励模型，学习给不同模型输出打分③ PPO 优化：用 RM 作为奖励信号，通过 PPO 算法更新策略模型，最大化 RM 给出的奖励，实现与人类偏好对齐手撕 LeetCode 原题：合并 k 个升序链表→ 核心思路：用小根堆维护 k 个链表的当前节点，每次弹出最小值节点并入结果链表，再将该节点的下一个节点入堆，直到所有链表遍历完毕；时间复杂度 O (N log k)，N 为总节点数

查看9道真题和解析

点赞评论收藏

分享

03-18 21:50

上海交通大学算法工程师

百度二面大模型研发凉经

继续来分享下之前的面经~欢迎友好讨论，信息共享1讨论项目2什么是GAE3解释deepseek的MLA，分析可能有什么缺点4介绍deepseekV3.2的闪电索引器和可能的缺点5介绍MHC残差连接6什么是多头注意力7口述两个算法题，说出求根号的多重方法（牛顿，梯度下降，二分），二分法求到小数点后k位精度算法复杂度8一个哈希表题目，不是力扣

查看8道真题和解析

点赞评论收藏

分享

03-18 14:40

门头沟学院推荐算法

小红书大模型算法实习面经

继续来分享下之前的面经~欢迎友好讨论，信息共享1. LLaMA 相比原始 Transformer 架构有哪些改进？2. 微调（Fine-tuning）和对齐（Alignment）的区别？3. 模型微调到什么程度才需要进行对齐？4. 四种对齐算法的区别：PPO、DPO、GRPO、DSPO？5. 位置编码的作用？为什么相对位置编码通常比绝对位置编码更好？6. GAE（Generalized Advantage Estimation）以及重要性采样（Importance Sampling）？7. 损失采样（Loss Sampling）相关问题？8. 目前了解哪些大模型架构？例如 LLaMA 等。9. 是否了解 PagedAttention？10. LoRA 中两个低秩矩阵是如何初始化的？11. PPO 中的四种模型分别是什么？各自的作用是什么？

查看11道真题和解析

点赞评论收藏

分享

02-27 09:35

门头沟学院机器学习

百度 LLM算法校招二面强度拉满了

发一下问题给大家参考，攒人品中。。。1.实习中多智能体系统包含几个智能体?它们之间如何交互?2.实习中意图识别模型需要识别多少个意图?3.750B模型用于什么场景?4.实习中Qwen3VL模型是多少B的?用于什么场景?5.在实习中，你主要的贡献是什么?6.检索环节做了哪些优化?7.答案生成环节做了哪些优化?8.是否做了SFT或强化学习相关工作?在哪个环节做的?9.SFT过程中是否对类别标签做了清洗或修正?10.强化学习的样本量是多少?11.基础模型经常分类分不准的案例有哪些?12.在校项目中，为什么用对话数据来增强数据集?13.在校项目任务的输出可以简单描述并举例吗?14.单智能体能否完成相在校项目关工作?为什么要智能体？15.LangGraph相对其他开源智能体编排工具的优点是什么?16.在现有场景中是否需要用到LangGraph的状态管理功能?17.如何理解Long-termMemory的实现方式?18.若将电商场景中用户的购买、点击、兴趣等信息设计为长期记忆，有什么想法?19.Context Window能否储存大量电商交互信息?如何解决存储问题?20.推理时若将大量Memory以Token形式给到大模型，Token长度过长该如何处理?21.强化学习有哪些常用技巧?22.若通过SFT进一步提升模型准确率，常用的手段有哪些?23.SFT的理想数据量是多少?如何确定?24.SFT数据分布一般怎么取?为什么选择该分布而非其他分布?

查看24道真题和解析

点赞评论收藏

分享

03-16 19:30

门头沟学院机器学习

网易大模型算法实习一面 1h

发一下问题给大家参考，攒攒人品！项目拷打八股1.bert和gpt的区别？2.训练/微调一个LLM的流程？3.实习时用的 megatron 框架吗，对分布式训练框架了解多少？4.了解强化学习吗，跟SFT有什么区别？

查看4道真题和解析

点赞评论收藏

分享

评论

点赞

收藏

全站热榜

更多

创作者周榜

更多

正在热议

更多

# 如何一边实习一边找下家？ #

28478次浏览 196人参与

# 职能管理面试记录 #

9136次浏览 38人参与

# MiniMax求职进展汇总 #

13943次浏览 230人参与

# 跟HR说什么能被秒回？ #

8803次浏览 159人参与

# 面试官最爱问的 AI 问题是...... #

14917次浏览 512人参与

# 春招/暑实第一面是哪家？ #

18769次浏览 219人参与

# 巨人网络春招 #

9946次浏览 163人参与

# 京东美团大战，你怎么看？ #

173962次浏览 881人参与

# 京东开奖 #

673064次浏览 3236人参与

# 你的嫡系AI是哪个？ #

3993次浏览 102人参与

# 现在入门AI应该走哪些方向？ #

3917次浏览 90人参与

# 把自己当AI，现在最消耗你token的问题是什么？ #

2779次浏览 85人参与

# 你收到了哪些公司的笔试？ #

16468次浏览 88人参与

# 巨人网络工作体验 #

74215次浏览 505人参与

# 巨人网络求职进展汇总 #

190701次浏览 1228人参与

# 实习生如何通过转正 #

129774次浏览 1475人参与

# 不卡学历的大厂有哪些？ #

161454次浏览 685人参与

# 你现在的工作，是“成长”还是“消耗”？ #

8125次浏览 140人参与

361046次浏览 2915人参与

# 联想求职进展汇总 #

340710次浏览 2229人参与

# 迅雷笔试 #

5400次浏览 27人参与

# 科大讯飞求职进展汇总 #

370310次浏览 3062人参与

牛客网
牛客网在线编程
牛客网题解
牛客企业服务