2025-07-29 16:42 已编辑同济大学算法工程师发布于黑龙江

关注

字节多模态算法二面挂

除了简历的论文，问了图像分类的问题：
交叉熵公式怎么推导的？你能否推一下
L2 loss和交叉熵loss 的区别？为什么图像分类中不用 L2 Loss?(我答可能出现梯度消失的问题，而且交叉熵考虑了每种分类的概率， L2 loss没有对概率进行考虑)
ROC曲线了不了解？(我回答是图像分类时的评价指标，横轴纵轴是Precision啥的，从混淆矩阵来的指标，用于评价模型的性能)
问了个题：
假设一种病在人群中发病率是1%，这种疾病检测的准确率是99%，请问这种病检测结果为阳性时实际患病的概率?（没答上来，好久没做过这种题了）
手撕代码：给一个序列，每次遍历的时候序列数字-1，减到0的时候这个数字变为6，之后数组末尾增加一个数，问n次之后数组长度多少(我暴力做的，面试管让优化，没优化出来)
手撕代码2：手搓一个图像卷积的函数，不允许使用库
第二天问hr，反馈不推进了

其实感觉聊得还可以，除了发病率那个题#牛客AI配图神器#

全部评论

推荐最新楼层

聪明的回笼觉觉主在写文章

哈尔滨工业大学（威海）算法工程师

本科还是硕士啊

1 回复分享

发布于 2025-08-03 22:41 山东

最终offer打牌的小山竹很机智

腾讯_TEG _Hunyuan_算法岗(准入职员工)

你这个是哪里base的部门？

点赞回复分享

发布于 2025-08-18 22:16 广东

在发动态的香菇很emo

门头沟学院算法工程师

请问您pub如何呢

点赞回复分享

发布于 2025-08-04 02:14 河北

山东师范大学运营

到底谁能进字节啊

点赞回复分享

发布于 2025-07-31 11:20 北京

03-16 19:00

同济大学算法工程师

蔚来大模型强化学习训练一面

📍面试公司：蔚来🕐面试时间：2026.03.16💻面试岗位：大语言模型强化学习算法实习生❓面试问题：自我介绍项目经历1，拷打项目动机，方法细节，评测方式，遇到的难点和解决方式，提出的方法为什么有效强化学习算法理论基础，介绍PPO算法，算法计算公式，优点，训练流程，介绍GRPO算法，特点，优势有关强化学习算法的代码库，TRL，VERL，Ray等询问对于Agentic RL 的认识，其中可能存在的难点，答了算法侧的稀疏奖励问题和工程实现上各类工具的稳定性编程题，word1->word2的最小操作次数🙌面试感想：自我介绍吟唱时间太长，适当压缩为教育背景，研究背景，项目/实习经历的简单介...

查看7道真题和解析

点赞评论收藏

分享

03-18 11:15

门头沟学院推荐算法

字节AI大模型算法二面

多模态模型横向对比除了 Video-LLaMA，还了解哪些主流多模态大模型？→ 常见的有 LLaVA、Flamingo、BLIP、BLIP-2、KOSMOS、PaLI 等简单介绍 ALBEF 和 BLIP 这两个模型的核心设计→ ALBEF：基于图像 - 文本对比学习，搭配动量蒸馏来优化图文对齐效果；BLIP：引入 captioner 生成高质量图文对，再结合 filter 机制筛选优质数据BLIP-2 的整体结构是什么？两阶段训练流程是怎样的？用到了哪些损失函数？→ 结构：在 ViT 和大语言模型之间插入 Q-Former 作为中间桥梁→ Stage1：冻结 ViT 和语言模型，只训练中间的 Q-Former→ Stage2：冻结语言模型，将 Q-Former 与 LM 连接，做指令微调→ 损失：ITC（图文对比损失）+ ITM（图文匹配损失）+ LM 生成损失微调方法（PEFT 全家桶）了解 PEFT 吗？再讲讲 LoRA，重点说明低秩假设的合理性→ PEFT 是参数高效微调的统称，核心是只训练少量参数而不动原模型权重；LoRA 假设模型权重更新量 ΔW 具有低秩特性，将其分解为 A×B，只训练 A、B 两个低秩矩阵，既节省显存又能保留效果除了 LoRA，还有哪些 PEFT 方法？Prefix-tuning 和 P-tuning 有什么区别？→ 其他方法：Adapter Tuning、Prefix-tuning、P-tuning、IA³ 等→ Prefix-tuning：在输入序列前加可学习的 prefix，作用于注意力的 K/V 矩阵，更适合 decoder-only 架构→ P-tuning：用小型网络（如 LSTM）生成连续的 soft prompt，解决离散 prompt 不稳定的问题，更适配 encoder-decoder 模型大模型训练范式你项目中用到的大模型结构是什么？多模态特征是如何喂给大模型的？→ 示例流程：视频帧 → TimeSformer 提取时空特征 → 特征池化 → 线性投影对齐到文本维度 → 拼接到文本 prompt 之前 → 输入 LLM大模型在做了指令微调后，为什么还需要 RLHF？→ 指令微调只是让模型学会遵循指令，但输出可能更偏向 “模板化”；RLHF 是通过人类偏好对齐，让模型输出更符合人类价值观、更自然、更有用的回答，解决 “有用性” 和 “安全性” 问题了解 RLHF 吗？描述它的完整训练流程→ 三阶段流程：① SFT 微调：用高质量指令数据对预训练模型做监督微调，让模型学会基本指令遵循② 训练 Reward Model（RM）：用人类标注的偏好数据训练奖励模型，学习给不同模型输出打分③ PPO 优化：用 RM 作为奖励信号，通过 PPO 算法更新策略模型，最大化 RM 给出的奖励，实现与人类偏好对齐手撕 LeetCode 原题：合并 k 个升序链表→ 核心思路：用小根堆维护 k 个链表的当前节点，每次弹出最小值节点并入结果链表，再将该节点的下一个节点入堆，直到所有链表遍历完毕；时间复杂度 O (N log k)，N 为总节点数

查看9道真题和解析

点赞评论收藏

分享

03-18 02:25

门头沟学院推荐算法

多模态大模型面经分享-字节

面试很难，还是要多多练习，感觉自己说不明白业务逻辑1.项目拷打2.讲一下你用的大模型是什么结构，特征是怎么喂给大模型的3.讲一下multi-head attention，用pytorch手撕一下，要可以实现cross attention的4.大模型训练为什么不用SFT5.知道RLHF吗，讲一下训练流程6.问了几个电商相关的场景题，用大模型解决 prompt 应该怎么设计，怎么处理prompt的输出，怎么过滤错误格式的输出

查看5道真题和解析

点赞评论收藏

分享

03-18 01:20

门头沟学院推荐算法

字节多模态大模型二面日常实习

攒攒人品！有面试过同岗的朋友欢迎评论区交流1.项目拷打2.论文拷打3.介绍transformer 架构4.BLIP2的结构是什么，两阶段怎么训练的，有哪些损失5.知道 PEFT 吗，讲一下 LoRA6.LoRA 是什么，有什么好处7.Transformer 怎么做加速训练，训练和推理有什么区别8.一些场景题

查看7道真题和解析

点赞评论收藏

分享

03-24 08:50

门头沟学院人工智能

腾讯大模型算法面试分享

发一下问题给大家参考，攒攒人品！1.实习拷打2.项目拷打3.在模型选择方面我已经了解了。总体来说，这是一个纯文本任务。虽然有图表参与其中，但你的整体评估体系是“规则打分 + 模型打分”混在一起用的进行混合评估的，也就是打分加加权。最终得分的这个逻辑吗？还是说是一个准确率的一个逻辑4.那接下来我觉得是你们这边来进行评测的，主要是通过一些固定规则，或者说通过RUBASE，或者是code coding的评分器吧，它是一个没有大模型参与打分的机制，可以这么理解吧，它是一个固定的评测器。那我这边的还有一个问题，对，然后你这边是说你在收集云和千问的SSD以及DPo数据。o那么您能否介绍一下，您是如何分别通过千问来处理SFT和DPO数据的5.你提到是规则和模型混合评估，那具体每一部分是怎么分工的？哪些是规则，哪些是模型？6.收集 Claude 和 Qwen 的 SFT 和 DPO 数据，具体是怎么构造这些数据的7.在大量模型生成数据中，如何筛选出用于训练的数据？8.SFT 和 DPO 数据在构造过程中，分别的筛选标准是什么？

查看8道真题和解析

点赞评论收藏

分享

评论

3

16

招聘动态

“联宝杯”

2026 大学生创新大赛

上海人工智能实验室

2026年春季校园招聘

联想

27届暑期实习

联想

26届补录

27届校招宝典

快手

27届实习超多转正机会

联宝科技

全站热榜

更多

创作者周榜

更多

正在热议

更多

# 如果春招能重来，我会___ #

27086次浏览 270人参与

# 机械人还在等华为开奖吗？ #

338782次浏览 1652人参与

# 在爱玛，骑向未来 #

18691次浏览 365人参与

# 这个offer值得去吗？ #

27876次浏览 202人参与

# 大学最后一个寒假，我想…… #

103031次浏览 846人参与

# 你会因为行情，降低找工作标准吗？ #

41834次浏览 309人参与

# 联宝杯大学生创新大赛，你的技术值得产业级答案 #

49006次浏览 603人参与

# 刚入职就____，这样正常吗？ #

147458次浏览 707人参与

# 去年你投递实习了吗？ #

32709次浏览 339人参与

# 字节开奖 #

157523次浏览 767人参与

# 记录我的毕业季 #

2970次浏览 81人参与

# 秋招盘点:机械人值得去的企业 #

106332次浏览 741人参与

# 你被哪些公司挂了？ #

194174次浏览 1051人参与

# 字节求职进展汇总 #

1856616次浏览 15490人参与

# 实习怎么做才有更好的产出 #

50713次浏览 464人参与

# 上班苦还是上学苦呢？ #

346264次浏览 2077人参与

# 非技术岗是怎么找实习的 #

338149次浏览 2663人参与

# 有深度的简历长什么样？ #

60490次浏览 771人参与

# 大学四年该怎么过，才不算浪费时间？ #

24298次浏览 109人参与

# 双非应该如何逆袭？ #

593065次浏览 6440人参与

# 现在入门AI应该走哪些方向？ #

30276次浏览 198人参与

# 我的秋招“寄”录 #

477267次浏览 3066人参与

牛客网
牛客网在线编程
牛客网题解
牛客企业服务