首页
题库
公司真题
专项练习
面试题库
在线编程
面试
面试经验
AI 模拟面试
简历
求职
学习
基础学习课
实战项目课
求职辅导课
专栏&文章
竞赛
搜索
我要招人
发布职位
发布职位、邀约牛人
更多企业解决方案
AI面试、笔试、校招、雇品
HR免费试用AI面试
最新面试提效必备
登录
/
注册
牛客218052891号
11-18 08:20
南京航空航天大学 网络工程师
发布于江苏
关注
已关注
取消关注
日常实习vivo南京,AI大模型方向
AI大模型方向日常实习招聘,base南京,有模型训练、算法调优经历的大佬赶紧投递!
全部评论
推荐
最新
楼层
牛客218052891号
楼主
南京航空航天大学 网络工程师
捞一捞
1
回复
分享
发布于 11-25 13:25
江苏
牛客218052891号
楼主
南京航空航天大学 网络工程师
快来vivo一起训模型!
1
回复
分享
发布于 11-21 15:22
江苏
牛客218052891号
楼主
南京航空航天大学 网络工程师
速来嗷!
1
回复
分享
发布于 11-20 23:13
江苏
牛客218052891号
楼主
南京航空航天大学 网络工程师
大佬们冲一下!
1
回复
分享
发布于 11-19 14:41
江苏
牛客955585161号
武汉大学 安全工程师
模型训练方向吗?
1
回复
分享
发布于 11-18 09:38
江苏
牛客218052891号
楼主
南京航空航天大学 网络工程师
速速投递!
点赞
回复
分享
发布于 11-28 15:46
江苏
牛客218052891号
楼主
南京航空航天大学 网络工程师
速来?
点赞
回复
分享
发布于 11-24 09:06
江苏
暂无评论,快来抢首评~
相关推荐
11-21 17:27
已编辑
门头沟学院 Java
PDD客户端二面面经 52min
手撕都做出来了,八股有三四个答得不太好,面完两个星期后收到感谢信哈哈哈哈自我介绍一下。**已经拿到Offer了吗?我看很多经历和博客分享都是后端,什么想法说是要做客户端?你觉得如果说让你做手机应用,就是APP这一块的开发,兴趣点或者优势,或者其他的一些东西,就是你觉得是怎么样的?你觉得后端和客户端最大的区别是什么?像**这段实习的话,主要讲一下做的一些事情吧。广州的这个实习经历,也全部讲一下。像你这个百万的数据量,如果是全部加载到内存里面,它大概占多少?这个百万条,每一行有多少列?一般是数字或者文本嘛,对不对?文本的话,它一个文本大概有多大?布隆过滤器的话,怎么确定布隆过滤器要用多大的?JVM...
查看21道真题和解析
点赞
评论
收藏
分享
11-19 23:50
已编辑
广东工业大学 产品经理
27届求大佬拷打简历
27届想找AI类实习,产品类实习。求拷打
投递字节跳动等公司10个岗位
点赞
评论
收藏
分享
11-07 15:54
门头沟学院 Java
求助,offer帮选
👋个人背景:java开发,不想太累
huohuo0111:
不想累 海康先去掉
点赞
评论
收藏
分享
11-24 09:01
已编辑
南京航空航天大学 网络工程师
vivo日常实习,工作地南京,模型算法
快来拿下你的第一段实习经历!有模型训练,模型调优经验大佬们速速投递base南京,AI安全算法,nlp方向
投递vivo等公司10个岗位
点赞
评论
收藏
分享
11-20 18:15
山东大学 算法工程师
阿里通义大模型算法二面已凉凉
1.实习介绍2. Lora 原理(核心是低秩分解:将原始权重更新近似为两个低秩矩阵乘积,减少参数量,保留主导方向,训练高效)3.了解 DeepSpeed 吗,ZeRO -1, ZeRO -2和 ZeRO3分别做了哪些优化(1优化优化器状态,2优化梯度,3切分参数,全面节省显存)4. Qwen的模型结构是怎么样的,相比于 LLaMA,DeepSeek 有什么区别(Qwen采用GQA+SwiGLU+RMSNorm,和LLaMA架构非常相似,差异在训练数据和tokenizer中文支持更好;DeepSeek只用MoE/MLA架构,Qwen系列主要是Dense模型)5.怎么缓解大模型的幻觉问题(RAG,RLHF对齐,事实监督)6.大模型的 MoE 结构相比于 Dense 结构训练的难点在什么地方,DeepSeekMoE为什么效果好,有什么值得我们借鉴创新点(MoE面临负载不均衡、训练不稳定问题;DeepSeekMoE通过细粒度专家和共享专家设计提升稳定性和效果)7.知道FP16和BF16有什么区别吗,包括FP32和INT8这些,在训练大模型的时候,应该怎么选择(FP16精度高但易溢出,BF16动态范围大;训练常用BF16混合精度,推理用INT8量化加速)8.讲-下 RLHF 的流程,写-下 PPO和 DPO的 Loss表达式(训练奖励模型后用PPO/DPO优化策略:PPO Loss: policy ratio + KL 约束/ DPO Loss: logit preference diff + sigmoid binary loss)9.对于超长上下文业界一般是怎么做的,你知道 Qwen是怎么做的吗(业界常用ROPE 变体/滑动窗口注意力/稀疏注意力等:Qwen使用YaRN和窗口注意力扩展上下文)10.开放题:你觉得目前大模型的上限在哪里(推理能力、长期记忆、具身交互和能耗效率,需要架构创新和多模态融合突破)11.代码:152.乘积最大子数组
查看9道真题和解析
点赞
评论
收藏
分享
一键发评
投递链接有吗
接好运
举报了
base南京?
模型训练指啥
评论
点赞成功,聊一聊 >
2
1
分享
评论
提到的真题
返回内容
全站热榜
更多
1
...
后端秋招24场100%胜率的SSP,真的只是靠卷技术吗?
2.7W
2
...
面试官别再问 AI 应用啦,我是真没招了
9876
华为开奖交流
热聊中
3
...
字节新年礼盒发相机,你们厂的开了嘛
5870
4
...
27纯血双非第二段大厂实习oc
5497
5
...
想要去北京实习但家人不支持
5151
6
...
老妈虽然舍不得,但是还是支持我去大城市
4772
7
...
本科秋招7SSP之旅
4596
8
...
临时有感
4040
9
...
京城有一场雪.
4020
10
...
秋招收官8个offer,出发TME
3999
创作者周榜
更多
正在热议
更多
#
为了去实习,我赌上了___
#
7573次浏览
83人参与
#
2025年终总结
#
1484次浏览
41人参与
#
哪一瞬间让你觉得“这班不如不上”
#
4169次浏览
74人参与
#
父母对你找工作是助力还是阻力?
#
5878次浏览
125人参与
#
十二月请对我好一点
#
13910次浏览
225人参与
#
工作前VS工作后,你的心态变化
#
6733次浏览
89人参与
#
一人推荐一个值得做的项目
#
4665次浏览
80人参与
#
滴滴工作体验
#
35284次浏览
145人参与
#
uu们,春招你还来吗?
#
3282次浏览
37人参与
#
高薪高压 vs 低薪wlb,你怎么选?
#
5254次浏览
58人参与
#
工作中出现了XX情况正常吗
#
16781次浏览
151人参与
#
得物app工作体验
#
39368次浏览
97人参与
#
你的实习什么时候入职
#
321419次浏览
2170人参与
#
bilibili求职进展汇总
#
173522次浏览
1069人参与
#
产品实习,你更倾向大公司or小公司
#
184657次浏览
2040人参与
#
秋招有哪些公司要求提前实习
#
91789次浏览
492人参与
#
公司福利里最没用的一项是啥
#
3471次浏览
70人参与
#
你面试被问到过哪些不会的问题?
#
103547次浏览
1859人参与
#
回顾今年你干过的最“勇”的一件事
#
7123次浏览
105人参与
#
被AI治愈的瞬间
#
82296次浏览
674人参与
牛客网
牛客网在线编程
牛客网题解
牛客企业服务