本文基于吴恩达的AI工程技能地图,重点解读了构建与部署AI应用的六项核心技能,包括LLM基础原理、数据喂养、智能体系统构建、评估驱动开发、生产环境运维和机器学习基础。文章强调了AI应用开发与传统软件开发的区别,即结果的不可预测性,并指出AI工程本质上是一种迭代调整的过程。吴恩达团队通过分析大量数据,提出了AI工程师的技能框架,旨在帮助读者更好地理解和应用大模型技术。
一句话结论
AI 应用开发和传统软件开发的根本区别:结果不可预测。 你不知道 LLM 会输出什么,也不知道模型会预测什么。所以 AI 工程本质上是一种”边做边看边调整”的迭代游戏,而不是”设计好了直接实现”的工程游戏。
吴恩达团队分析了大量招聘信息、专家访谈和调研数据,梳理出 AI 工程师的技能地图,最顶层分四块:
-
构建与部署 AI 应用(本文重点)
-
软件工程基础
-
使用编码智能体
-
塑造构建过程
今天只讲第一块——也是最核心的一块,拆解成 6 项技能。
六项技能,一图看懂

| 技能 | 解决什么问题 |
|---|---|
| LLM 基础原理 | 模型什么时候可信,什么时候会翻车 |
| 用数据喂饱模型 | 怎么让模型拿到”对的”上下文 |
| 构建智能体系统 | 工作流 or 自主 Agent,怎么选怎么搭 |
| 评估驱动开发 | 怎么科学判断”下一步该做什么” |
| 生产环境运维 | 上线之后怎么不翻车、不烧钱 |
| 机器学习基础 | 底层的地基,撑起上面所有判断 |
- LLM 基础原理:判断模型能力边界
懂分词(tokenize)、懂生成机制,才能判断什么时候该信模型、什么时候不该信。
具体体现在这些决策上:
- 要不要上多模态模型
- 上下文窗口塞不下时,什么该留什么该舍
- 怎么利用缓存命中降本
- 知识截止日期会不会成为坑
- 推理强度、采样参数怎么调
- 什么时候该用工具调用(tool calling)
一句话:这是后续所有选型(微调、自托管)的地基。
- 用数据喂饱模型:RAG 只是起点
RAG + 向量检索只是”喂数据”的第一代方案,现在的选择已经多得多:
- 写进 Prompt 还是让模型按需检索?
- 用向量索引、知识图谱、还是结构化数据的语义层?
- 文本/PDF/HTML/图片怎么统一转成模型能吃的格式?
- 数据管道怎么保证干净、新鲜?
核心不是”用不用 RAG”,而是知道整个技术菜单,按场景选对工具。
- 构建智能体系统:从原型到能上生产的 Agent
Agentic 系统是个光谱:一头是预定义步骤的工作流,另一头是自主决策下一步的 Agent。
要做的决策包括:
- 架构上:哪些步骤串行、哪些并行、哪些交给代码、哪些交给 LLM
- 工具怎么给:MCP、CLI、沙箱执行环境
- 记忆架构怎么设计
- 长会话怎么管理上下文
- 单 Agent 够不够,要不要上多 Agent 编排
更关键的是:能跑的原型 ≠ 能上生产的系统。真正难的是护栏机制、对抗性输入防御、数据泄露等风险治理。
顺带一提,语音 Agent、Computer Use、生成式 UI 这些前沿方向也值得关注。
- 评估驱动开发:区分高手和普通人的分水岭
吴恩达原话大意:能不能跑通一套严谨的评估/错误分析循环,是判断一个人是否真正擅长构建 AI 系统的最重要标志。
这也是最难的一项,因为方法论会随项目、随阶段变化。核心工作包括:
- 看 trace、看输出,做探索性数据分析
- 结合业务判断到底该测什么
- 会选评估方式:代码规则判断 / LLM-as-judge / 人工评审,三选一或组合
- 评估体系本身也要持续被评估、被迭代
没有这一环,AI 系统的进步就是碰运气;有了这一环,才是系统化的工程。
- 生产环境运维:上线才是开始
AI 系统运维难在三点:不可预测、贵、慢。
- 可观测性:追踪线上表现、检测模型漂移、快速响应失效和 prompt 注入攻击
- 回归测试 & CI/CD:比传统软件更依赖统计评估,测试力度要按风险分级
- 成本与延迟优化:模型选型、蒸馏、微调、简化 Agent 工作流,组合拳降本增效
- 机器学习基础:看不见但决定上限的地基
LLM 本身就是监督学习+强化学习的产物。吴恩达观察到:真正厉害的 LLM 应用工程师,无一例外都懂机器学习和深度学习。
而且很多场景仍然需要直接用/训练传统 ML 模型,这要求你懂:
- 主流模型在准确率、训练速度、推理速度上的取舍
- 怎么为训练和评估工程化数据
最关键的是偏差/方差分析、错误分析、数据工程这套思维框架——这不只是 ML 的基本功,更是驾驭”输出不确定系统”的通用心法,贯穿以上五项技能的方方面面。
总结
六项技能不是并列关系,更像是一条主线加两个支撑:
-
①②③ 是主线:理解模型 → 喂好数据 → 搭好 Agent,构成”做出来”的核心链条
-
④ 是贯穿全程的方法论:不是某个阶段的活,而是①②③每一步迭代都要用的判断工具
-
⑤ 是从原型到产品的临门一脚
-
⑥ 是底层地基,支撑上面所有判断
最后
2026 年一晃已经过半,AI 大模型的热潮不仅没有降温,反而持续升温!
金融行业用大模型做风控、医疗依靠 AI 解析影像,电商、制造、教育各行各业,都在把 AI 融入日常业务。曾经热闹的 “百模大战”,早就告别单纯比拼模型参数,正式进入落地应用时代。
现在企业疯狂紧缺一类人才:懂业务、懂 AI、能做出可上线项目的大模型开发工程师,岗位缺口大,薪资待遇十分可观。

风口再好,不如手握高薪 offer 实在。行情火热,普通人、程序员该怎样从零入门大模型,抓住这波机会?
今天整理好【2026 最新版】AI 大模型全套免费学习资源,覆盖零基础入门、项目实战、理论知识、大厂面试,从基础一路进阶。所有资料分类归档,没有多余杂料,无套路免费分享给想要入局 AI 赛道的程序员与零基础小白!
👇👇扫码免费领取全部内容👇👇

1、大模型系统化完整学习路线

2、大模型经典书籍&文档

3、AI 大模型最新行业研究报告

4、企业级实战项目 + 完整配套源码

5、大厂大模型面试真题汇总

6、这些资料真的有用吗?
这份资料由我和鲁为民博士(北京清华大学学士和美国加州理工学院博士)共同整理,现任上海殷泊信息科技CEO,其创立的MoPaaS云平台获Forrester全球’强劲表现者’认证,服务航天科工、国家电网等1000+企业,以第一作者在IEEE Transactions发表论文50+篇,获NASA JPL火星探测系统强化学习专利等35项中美专利。本套AI大模型课程由清华大学-加州理工双料博士、吴文俊人工智能奖得主鲁为民教授领衔研发。
资料内容涵盖了从入门到进阶的各类视频教程和实战项目,无论你是小白还是有些技术基础的技术人员,这份资料都绝对能帮助你提升薪资待遇,转行大模型岗位。


这份完整版的大模型 AI 学习资料已经上传CSDN,朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】


2285

被折叠的 条评论
为什么被折叠?



