AI infra应该学什么?

AI Infra 是未来 5–10 年非常确定的岗位方向之一,而且相比纯算法岗,门槛更工程化、需求更大、年龄更友好

AI Infra 技能栈

你可以把技能栈理解为 4 层:

第1层:基础工程能力(必须)

这是门槛:

  • Linux
  • Python / Go
  • 计算机网络
  • 操作系统
  • Docker
  • Kubernetes
  • 数据库(MySQL / Redis)
  • 分布式系统基础
  • API开发(FastAPI / Flask)
  • 并发 / 异步 / 队列(Kafka / RabbitMQ)

这一层本质是:后端工程师能力

第2层:AI工程能力

这一层开始进入 AI Infra:

  • PyTorch 基础
  • 模型推理(inference)
  • 模型部署(TorchServe / Triton)
  • ONNX / TensorRT
  • vLLM / TGI / LMDeploy
  • Embedding / 向量数据库MilvusFAISSWeaviatepgvector
  • RAG(检索增强生成)
  • Prompt 工程
  • Agent 框架LangChainLlamaIndexAutoGenCrewAI

第3层:系统能力(高薪区)

这一层是专家岗做的事:

  • GPU 调度
  • 分布式训练(DeepSpeed / FSDP)
  • 推理优化
  • KV Cache
  • Batch 推理
  • Token 优化
  • 成本优化
  • 高并发系统设计
  • 模型服务化(Model Serving)
  • 多 Agent 系统架构
  • Memory 系统
  • Tool 调用系统

第4层:AI 平台能力(更偏架构)

例如:

  • AI 平台
  • 数据平台
  • 训练平台
  • Agent 平台
  • Prompt 平台
  • Evaluation 平台
  • Feature Store
  • 实验平台

这一层已经是 架构师 / Infra负责人 级别。

对应岗位名称

你以后找工作不要只搜“AI工程师”,要搜这些:

常见岗位名:

  • AI Infra 工程师
  • 机器学习平台工程师(ML Platform)
  • MLOps 工程师
  • LLM Infra 工程师
  • 推理工程师(Inference Engineer)
  • 模型部署工程师
  • AI 后端工程师
  • AI 平台工程师
  • GPU / 分布式训练工程师
  • 向量检索工程师
  • RAG 工程师
  • Agent 平台工程师

公司 JD 关键词:

  • RAG
  • Agent
  • LLM
  • vLLM
  • Triton
  • TensorRT
  • 向量数据库
  • Kubernetes
  • 推理优化
  • 高并发
  • 分布式
  • GPU

看到这些词,基本就是 AI Infra 岗。

入行路径

路线1(最推荐):后端 → AI Infra

路径:后端工程师 → AI后端 → RAG工程师 → AI Infra工程师

先学:

  • Python
  • FastAPI
  • MySQL / Redis
  • Docker
  • Linux

然后做项目:

  • 做一个 RAG 问答系统
  • 做一个 Agent 调用工具系统
  • 部署一个开源模型
  • 做一个向量检索系统
  • 做一个多 Agent workflow

你只要能做出:

  • 文档问答系统(RAG)
  • Agent 自动调用工具
  • 模型部署 API
  • 高并发请求处理

就已经是 AI Infra 初级工程师水平 了。

建议做的项目方向

如果你真的想入行,建议做这 4 个项目写在简历上:

  1. 本地部署大模型 + API 服务vLLM / Ollama / LMDeployFastAPI 提供接口
  2. RAG 系统文档 → 切分 → embedding → 向量数据库 → 检索 → LLM生成
  3. Agent 系统LLM + Tool 调用例如:自动查天气 / 查数据库 / 发邮件 / 调接口
  4. 高并发测试压测缓存队列限流

你可以用这个判断自己是否进入 AI Infra:

如果你每天在做的是:

  • 调 Prompt → 偏应用
  • 训练模型 → 偏算法
  • 做 RAG → AI工程
  • 做 Agent → AI工程
  • 部署模型 → AI Infra
  • 优化推理速度 → AI Infra
  • GPU 调度 → AI Infra
  • 成本优化 → AI Infra
  • 高并发系统 → AI Infra

#从事AI岗需要掌握哪些技术栈?#
全部评论
你的入行路径和项目烂完了。你这个入行路径和项目就老老实实agent 开发吧
2 回复 分享
发布于 03-28 17:34 上海
AI芯片驱动算吗
点赞 回复 分享
发布于 04-15 14:19 浙江

相关推荐

📍面试公司:小米🕐面试时间:2026/03/26(二十分钟草草收场,都不想去看结果就知道挂了)💻面试岗位:大模型推理优化❓面试问题:一、自我介绍二、八股问题拷打,其实上来就是手撕1、直接在编辑器上手撕MGA,要求写出init、forward、注意力层   ——丢人现眼了,基本不会写2、追问,不会写的话讲一下整个过程,输入到输出怎么样的?         ——讲了讲transformer,注意力机制3、vllm和sglang的底层代码有看过吗?                                          ——没看过(其实看过,但我不敢说,怕叫我写)4、kv cache有哪些加载方式?                                                        ——在胡言乱语,啊这个,啊那个5、PD分离机制是干什么的?你怎么实现的?                                   ——唯一能回答的问题6、有没有用vllm部署过模型?吞吐量是多少?                                 ——脑子昏了,沉默(跑了demo,没测过)7、MTP(可能是MCP?没听清)是什么,介绍一下?                     ——我估计想问Medusa?反正我没回答,沉默。到这他问不下去了。。。三、反问两个人尴尬一笑,没什么要问的了。🙌面试感想:应该是史上最无悬念的秒挂,第一个手撕不会之后我已经晕头转向了,加上昨天熬夜到五点,到后面我都有点不好意思了,感觉在浪费他的时间,在这里跟他道个歉😀。十月到现在算上开发+infra可能面了二十多家吧,大部分都是秒挂,感觉车企infra这块的要求都特别高吧,问的特别细,就是最新的技术一定都要掌握,这一块技术迭代感觉特别特别快,光背八股面经给我感觉不太行。鼠鼠也累了,但自觉已经尽力了。也感谢这些至少还给机会面试的公司吧,有些简历直接投垃圾桶里了。(希望下一届的同学早早准备,不要像鼠鼠一样还在为春招奔波)。
查看8道真题和解析
点赞 评论 收藏
分享
评论
9
62
分享

创作者周榜

更多
牛客网
牛客网在线编程
牛客网题解
牛客企业服务