AI、机器学习、深度学习、LLM,到底是什么关系?

副标题:把基础模型、多模态与生成式 AI 放回正确坐标
资料校准日期:2026 年 9 月 02 日
适合读者:AI 初学者、产品经理、研发工程师,以及希望系统补齐 AI 基础概念的读者
第 1 篇,我们先画了一张 AI 应用全景地图。随后几篇沿着 RAG、Workflow、Agent 和协议逐步深入,讲了模型怎样连接知识、工具和业务系统。
但越往工程深处走,越需要回头校准地基:AI、机器学习、深度学习、Transformer、基础模型、LLM、多模态模型和生成式 AI,究竟是不是一条从大到小的包含关系?
答案是:只有其中一部分可以这样理解。很多名词分别描述技术领域、学习范式、网络架构、模型类别、能力类型和应用系统。把它们强行排成一条线,正是“名词越学越乱”的根源。
所以从第 14 篇开始,会暂时从 Agent 工程退回来,先把基础坐标补完整,再逐步进入模型训练、推理和完整应用架构。
一、AI 名词为什么越学越乱
我们经常看到类似的排列:AI → 机器学习 → 深度学习 → Transformer → LLM → RAG → Agent。它看起来很整齐,却把完全不同维度的概念混到了一起。

AI 是一个广泛领域;机器学习和深度学习是实现智能能力的技术范式;Transformer 是神经网络架构;LLM 是模型类别;生成式 AI 描述一类生成能力和应用范式;RAG、Workflow、Agent 则是应用系统中的工程模式。
它们当然有关联,但“有关联”不等于“具有父子包含关系”。先判断一个名词在回答什么问题,比先背定义更重要。
二、先建立六个互相正交的坐标
理解一个 AI 名词时,会先把它放进六个坐标:领域、学习范式、网络架构、模型类别、能力类型和系统工程。

- 领域
回答“我们在研究和构建什么”:AI。
- 学习范式
回答“系统从什么反馈信号中学习”:监督、自监督、强化学习等。
- 网络架构
回答“模型内部怎样组织计算”:CNN、RNN、Transformer 等。
- 模型类别
回答“模型处理什么数据\、承担什么基础角色”:LLM、多模态模型、扩散模型、基础模型等。
- 能力类型
回答“系统能做什么”:分类、预测、生成、检索、规划等。
- 系统工程
回答“怎样把模型变成可用产品”:RAG、Tool Calling、Workflow、Agent、评估与治理。
同一套系统可以同时落在六个坐标上。例如企业助手可以使用自监督预训练的 Transformer 类 LLM,具备文本生成能力,并在应用层通过 RAG、工具和 Workflow 完成业务任务。
三、AI、机器学习和深度学习是准确的包含关系
在常见技术语境中,深度学习 ⊂ 机器学习 ⊂ 人工智能 是成立的。但这张集合图只回答“技术方法所属范围”,不能继续无限向右追加所有热词。

人工智能(Artificial Intelligence,AI)是让机器表现出感知、推理、学习、规划、决策或行动能力的广泛领域。AI 不只包含机器学习,还包括规则系统、搜索、规划、知识表示等方法。
机器学习(Machine Learning,ML)让系统从数据或交互经验中学习规律,而不是由开发者把每条判断规则全部手写出来。
深度学习(Deep Learning,DL)是机器学习的一类方法,通常使用具有多层表示学习能力的神经网络。它擅长从图像、声音和文本等复杂数据中自动学习特征。
常见误区是“现在的 AI 就等于大模型”。大模型是当代 AI 的重要路径,但 AI 的范围比大模型更广,很多业务系统仍会组合规则、搜索、优化算法和机器学习模型。
四、监督、无监督、自监督和强化学习是学习范式
学习范式不是模型名称。它描述训练时提供什么数据、什么反馈信号,以及模型被要求学会什么。

监督学习使用带标签样本,例如“这封邮件是垃圾邮件”“这张图是猫”。模型学习输入到目标标签或数值的映射。
无监督学习通常没有人工目标标签,重点是发现数据结构,例如聚类、降维和异常模式。
自监督学习从原始数据本身构造训练信号。例如遮住部分文本让模型预测,或根据前文预测后续 Token。现代基础模型的大规模预训练大量采用自监督目标。
强化学习让智能体在环境中行动,根据奖励信号学习策略。奖励可能延迟出现,所以它关注连续决策及长期回报,而不是单个样本的正确标签。
这些范式并非互斥的产品标签。一个模型可能先自监督预训练,再用监督数据微调,随后使用人类或规则反馈进一步对齐。
五、神经网络不等于深度学习
神经网络是一类计算模型;深度学习强调使用多层网络学习层次化表示。两者高度相关,但不是两个可以随意互换的名称。

传统机器学习经常依赖人工特征:先由人提取关键词、纹理或统计指标,再交给模型分类。深度神经网络则可以让靠近输入的层学习局部模式,中间层组合更复杂结构,后面的层形成与任务相关的高级表示。
这里的“深”不是单纯层数越多越好。网络能否训练稳定、数据是否充足、任务是否需要复杂表示,以及计算成本是否可接受,都决定了架构选择。
六、Transformer 是架构,不是 LLM 的同义词
Transformer 最初在 2017 年论文《Attention Is All You Need》中提出,是一种以注意力机制为核心的神经网络架构。

它解决的是序列信息怎样交互和并行计算的问题。现代很多 LLM 使用 Transformer 或其变体,但两者仍不等同:
- Transformer 是“计算结构怎么组织”。
- LLM 是“面向语言、具有较大规模的一类模型”。
- Transformer 也被用于视觉、语音和多模态任务。
- 从概念上说,模型类别不由单一架构永久绑定。
因此,把 Transformer 画成 AI、ML、DL 之后的“下一层”,会同时混淆方法集合、网络架构和模型类别。
七、基础模型强调广泛预训练与下游适配
Stanford CRFM 将基础模型(Foundation Model)概括为:在广泛数据上大规模训练,并能适配许多下游任务的模型。

“基础”不是说它天然正确或可以直接上线,而是说许多下游应用建立在它之上。适配方式可以是 Prompt、检索增强、微调、参数高效微调、工具接入或任务专用头。
基础模型可以面向语言,也可以面向视觉、语音或多模态。它的关键特征是广泛训练、可迁移性和下游基础作用,而不是固定参数规模或某一种产品形态。
基础模型还会带来“同源风险”:偏差、缺陷和能力变化可能沿着大量下游应用传播,所以评估、版本管理和治理非常重要。
八、LLM 是模型类别,不是全部生成式 AI
大型语言模型(Large Language Model,LLM)强调语言建模能力、训练规模和对文本或语言化信息的处理。很多现代 LLM 同时承担基础模型角色,但“LLM”和“基础模型”强调的是不同属性。

更准确的理解是:
- LLM 关注语言模型这一类别。
- 基础模型关注广泛预训练后支撑下游任务的角色。
- 许多主流 LLM 是基础模型,但基础模型不只包括语言模型。
- LLM 常具有生成能力,也能通过提示或适配完成分类、抽取、排序等判别任务。
所以“LLM = 生成式 AI = AI”是三次范围扩张。LLM 只是生成式 AI 的重要技术基础之一,更不是全部 AI。
九、多模态模型连接不同信息模态
文本、图像、音频和视频是不同模态。多模态模型(Multimodal Model)能够接收、关联或生成两种及以上模态的信息。

它可能把不同输入编码到可关联的表示空间,也可能通过跨模态注意力或连接模块让文本与视觉、音频信息相互影响。例如看图问答、视频理解、语音助手、文生图和实时语音交互。
“多模态”描述处理的数据范围与交互能力,不等于某一种固定架构。系统支持上传图片,也不代表它真正理解所有视觉细节;分辨率、采样、时序、工具链和评估集都会影响实际效果。
十、生成式 AI 是能力与应用范式
生成式 AI(Generative AI)关注根据输入生成新内容,包括文本、代码、图像、音频、视频和结构化数据。

它不应该被放在 AI → ML → DL 集合之后,当成一个更小的技术子层级。更合适的画法是把“生成”看作一条能力轴:不同模型家族都可能提供生成能力。
LLM 可以生成文本和代码;扩散模型常用于图像、音频或视频生成;多模态模型可以跨模态理解与生成。同一个产品还可能同时使用生成模型、检索系统、分类模型和确定性规则。
十一、判别式任务与生成式任务有什么不同
判别式任务重点是在给定候选或目标空间中做判断,例如分类、回归、排序和检测;生成式任务重点是产生新的内容或数据序列。

邮件分类器输出“垃圾邮件/正常邮件”,属于判别;模型撰写一封回复邮件,属于生成。合同风险评分属于判别;生成修改建议和条款草案属于生成。
但不要把“模型”永久分成两座孤岛。同一个基础模型可以通过不同输入、输出约束和适配方式完成生成、分类、抽取和评分。这里比较的是任务及输出形式,不是给所有模型贴唯一标签。
十二、模型能力不等于完整系统能力
模型提供语言理解、表示、推理或生成能力,但企业应用还需要知识、数据\、工具、流程、身份、权限、状态、评估和监控。

模型“知道如何写差旅申请”不代表它知道公司最新制度;模型能生成工具参数,不代表它拥有执行权限;模型回复“已经创建”也不代表业务系统真的产生了申请记录。
完整系统必须把不稳定的模型输出放进可验证的工程边界:外部事实通过检索或数据库提供,真实动作由应用执行,关键路径由 Workflow 控制,高风险操作由策略和人工审批约束。
十三、RAG、Workflow 和 Agent 位于应用工程层
RAG、Workflow、Tool Calling 和 Agent 都不是新的模型层级。它们描述的是应用怎样组织模型、知识、工具、状态和控制权。

- RAG
在生成前检索外部知识,为模型提供更相关、可更新、可引用的上下文。
- Tool Calling
让模型提出结构化工具调用请求,应用负责校验和执行。
- Workflow
由代码或流程图预先定义候选路径、状态转移和恢复语义。
- Agent
让模型在约束内根据目标和状态动态选择下一步。
它们可以使用相同的 LLM,也可以组合出现。区别主要在系统编排与控制模型,而不是底层模型突然变成了另一个物种。
十四、把企业助手的各部分放回正确层级
现在再看贯穿本系列的企业知识与业务助手,就能把每个组件放回自己的位置。

用户在交互层提出“查询北京差旅标准并创建申请”。应用层负责界面和业务语义;编排层用 Workflow 控制查询、确认、审批和写入;能力层提供 RAG、工具调用或局部 Agent;模型层使用 LLM 理解语言和生成结构化结果;数据层保存制度、员工与业务状态;治理层贯穿身份、权限、审计、评估和成本。
这里没有任何一个组件可以单独代表整套系统。模型决定能力上限,工程系统决定能力能否被可靠使用。
十五、接下来按什么顺序学习
完成概念校准后,后续会沿着“内部机制 → 模型类别 → 训练适配 → 使用方法 → 多模态应用 → 完整系统”推进。

资料依据
-
NIST Computer Security Resource Center, Artificial Intelligence
-
Google for Developers, Machine Learning Glossary
-
Stanford CRFM, On the Opportunities and Risks of Foundation Models
-
Stanford CRFM, Reflections on Foundation Models
-
Vaswani et al., Attention Is All You Need
说明:本文把“领域、学习范式、网络架构、模型类别、能力类型、系统工程”作为概念校准框架;这是一种帮助学习和选型的工程整理方式,不是某一官方机构规定的唯一分类法。
“最先掌握AI的人,将会比较晚掌握AI的人有竞争优势”。
这句话,放在计算机、互联网、移动互联网的开局时期,都是一样的道理。
我在一线互联网企业工作十余年里,指导过不少同行后辈。帮助很多人得到了学习和成长。
我意识到有很多经验和知识值得分享给大家,故此将并将重要的AI大模型资料包括AI大模型入门学习思维导图、精品AI大模型学习书籍手册、视频教程、实战学习等录播视频免费分享出来。【保证100%免费】🆓
CSDN粉丝独家福利
这份完整版的 AI 大模型学习资料已经上传CSDN,朋友们如果需要可以扫描下方二维码&点击下方CSDN官方认证链接免费领取 【保证100%免费】

对于0基础小白入门:
如果你是零基础小白,想快速入门大模型是可以考虑的。
一方面是学习时间相对较短,学习内容更全面更集中。
二方面是可以根据这些资料规划好学习计划和方向。
👉1.大模型入门学习思维导图👈
要学习一门新的技术,作为新手一定要先学习成长路线图,方向不对,努力白费。
对于从来没有接触过AI大模型的同学,我们帮你准备了详细的学习成长路线图&学习规划。可以说是最科学最系统的学习路线,大家跟着这个大的方向学习准没问题。(全套教程文末领取哈)

👉2.AGI大模型配套视频👈
很多朋友都不喜欢晦涩的文字,我也为大家准备了视频教程,每个章节都是当前板块的精华浓缩。


👉3.大模型实际应用报告合集👈
这套包含640份报告的合集,涵盖了AI大模型的理论研究、技术实现、行业应用等多个方面。无论您是科研人员、工程师,还是对AI大模型感兴趣的爱好者,这套报告合集都将为您提供宝贵的信息和启示。(全套教程文末领取哈)

👉4.大模型实战项目&项目源码👈
光学理论是没用的,要学会跟着一起做,要动手实操,才能将自己的所学运用到实际当中去,这时候可以搞点实战项目来学习。(全套教程文末领取哈)

👉5.大模型经典学习电子书👈
随着人工智能技术的飞速发展,AI大模型已经成为了当今科技领域的一大热点。这些大型预训练模型,如GPT-3、BERT、XLNet等,以其强大的语言理解和生成能力,正在改变我们对人工智能的认识。 那以下这些PDF籍就是非常不错的学习资源。(全套教程文末领取哈)

👉6.大模型面试题&答案👈
截至目前大模型已经超过200个,在大模型纵横的时代,不仅大模型技术越来越卷,就连大模型相关的岗位和面试也开始越来越卷了。为了让大家更容易上车大模型算法赛道,我总结了大模型常考的面试题。(全套教程文末领取哈)

为什么分享这些资料?
只要你是真心想学AI大模型,我这份资料就可以无偿分享给你学习,我国在这方面的相关人才比较紧缺,大模型行业确实也需要更多的有志之士加入进来,我也真心希望帮助大家学好这门技术,如果日后有什么学习上的问题,欢迎找我交流,有技术上面的问题,我是很愿意去帮助大家的!
这些资料真的有用吗?
这份资料由我和鲁为民博士共同整理,鲁为民博士先后获得了北京清华大学学士和美国加州理工学院博士学位,在包括IEEE Transactions等学术期刊和诸多国际会议上发表了超过50篇学术论文、取得了多项美国和中国发明专利,同时还斩获了吴文俊人工智能科学技术奖。目前我正在和鲁博士共同进行人工智能的研究。
资料内容涵盖了从入门到进阶的各类视频教程和实战项目,无论你是小白还是有些技术基础的,这份资料都绝对能帮助你提升薪资待遇,转行大模型岗位。


CSDN粉丝独家福利
这份完整版的 AI 大模型学习资料已经上传CSDN,朋友们如果需要可以扫描下方二维码&点击下方CSDN官方认证链接免费领取 【保证100%免费】

CSDN粉丝独家福利
这份完整版的 AI 大模型学习资料已经上传CSDN,朋友们如果需要可以扫描下方二维码&点击下方CSDN官方认证链接免费领取 【保证100%免费】

CSDN粉丝独家福利
这份完整版的 AI 大模型学习资料已经上传CSDN,朋友们如果需要可以扫描下方二维码&点击下方CSDN官方认证链接免费领取 【保证100%免费】


被折叠的 条评论
为什么被折叠?



