同花顺 AIGC算法实习 一面

共40分钟

1.自我介绍

2.拷打第一个项目,先让我详细介绍,然后开始提问,主要提问了强化学习里面奖励函数、ppo算法、KL散度相关的;

3.拷打第二个项目,先让我详细介绍,然后问我向量数据库怎么构建的、数据预处理相关的、向量数据库数据量、lora微调的数据量、对比解码减少幻觉的原理、比赛相关的;

4.反问,问了做什么业务和部门氛围

面试官人很好,这次没算法题,整体感觉还是挺好的,八股还是没有单独问,有路过的佬能说一下去同花顺怎么样吗?

—————————————————-

更新,hr很想让我去,约二面了,但是考虑到钱少事多(?),就祭出苦命话术把面试推了

#实习#
#算法#  #面试中的破防瞬间#  #实习,投递多份简历没人回复怎么办#  #简历被挂麻了,求建议#
全部评论
同花顺钱少吗?不是杭州同领域基本最高薪资吗,因为是加班最多的
点赞 回复 分享
发布于 2024-06-20 19:38 日本
听你和评论区的大佬们这么一说,我也对同花顺不抱什么希望了。之前也是面试过这公司,体验感极差,两次通知面试都没有及时发我视频会议号,另外他们还专门整一个自己的会议app来开会的。
点赞 回复 分享
发布于 2024-04-17 11:09 香港
拿了offer但没去,好像开5k没房补有餐补,位置也是杭州西溪园区这块
点赞 回复 分享
发布于 2024-04-07 09:53 浙江
什么公司的呀
点赞 回复 分享
发布于 2024-04-07 01:01 北京

相关推荐

1.实习介绍2. Lora 原理(核心是低秩分解:将原始权重更新近似为两个低秩矩阵乘积,减少参数量,保留主导方向,训练高效)3.了解 DeepSpeed 吗,ZeRO -1, ZeRO -2和 ZeRO3分别做了哪些优化(1优化优化器状态,2优化梯度,3切分参数,全面节省显存)4. Qwen的模型结构是怎么样的,相比于 LLaMA,DeepSeek 有什么区别(Qwen采用GQA+SwiGLU+RMSNorm,和LLaMA架构非常相似,差异在训练数据和tokenizer中文支持更好;DeepSeek只用MoE/MLA架构,Qwen系列主要是Dense模型)5.怎么缓解大模型的幻觉问题(RAG,RLHF对齐,事实监督)6.大模型的 MoE 结构相比于 Dense 结构训练的难点在什么地方,DeepSeekMoE为什么效果好,有什么值得我们借鉴创新点(MoE面临负载不均衡、训练不稳定问题;DeepSeekMoE通过细粒度专家和共享专家设计提升稳定性和效果)7.知道FP16和BF16有什么区别吗,包括FP32和INT8这些,在训练大模型的时候,应该怎么选择(FP16精度高但易溢出,BF16动态范围大;训练常用BF16混合精度,推理用INT8量化加速)8.讲-下 RLHF 的流程,写-下 PPO和 DPO的 Loss表达式(训练奖励模型后用PPO/DPO优化策略:PPO Loss: policy ratio + KL 约束/ DPO Loss: logit preference diff + sigmoid binary loss)9.对于超长上下文业界一般是怎么做的,你知道 Qwen是怎么做的吗(业界常用ROPE 变体/滑动窗口注意力/稀疏注意力等:Qwen使用YaRN和窗口注意力扩展上下文)10.开放题:你觉得目前大模型的上限在哪里(推理能力、长期记忆、具身交互和能耗效率,需要架构创新和多模态融合突破)11.代码:152.乘积最大子数组
查看9道真题和解析
点赞 评论 收藏
分享
1.你的 Agent 系统Prompt 是怎么设计和迭代的?有没有做过 Prompt 自动优化?当用户提出不完整的请求时,如何补全用户意图的?2.构建 Agent 的时候,遇到过哪些瓶颈?LangChain 的 memory 默认机制在多3.用户并发中怎么做隔离?你是如何保证线程安全的?4.微调 Llama2 你是怎么选择训练样本的?清洗逻辑是什么?你有没有观察到哪些训练样本质量问题对模型行为有很大影响?举例说明。5.DPO相比 SFT,有哪些优劣?它在 Agent 任务上效果提升明显吗?你怎么构造偏好对?构造逻辑是自动的还是人工?6.你说你服务部署在 vLLM 上,为何选择它?KV-cache 如何帮助推理加速?你自己做过哪些优化?7.假如需要支持 Streaming 输出,但当前服务延迟又超标,你会怎么折中设计?8.多轮对话上下文状态管理是如何做的?如何在高并发场景下保证一致性?9.你做的 Agent 使用了多少个外部工具,在调用链条上如何保障故障容错和超时机制?10.有没有做过工具调用失败后的feedback策略设计?11.训练过程中数据来自用户行为日志,你是如何从这些数据中抽取训练对话的?有没有做过归一化或事件抽象?12.有没有了解过带有时间窗口/偏移限制的对话系统?模型怎么“理解时间”?13.你觉得 Agent 哪些模块最容易在真实业务中出问题?你会如何监控和定位的?
查看13道真题和解析
点赞 评论 收藏
分享
评论
1
8
分享

创作者周榜

更多
牛客网
牛客网在线编程
牛客网题解
牛客企业服务