从答题到干活!高盛断言:Agent进入执行时代,拼的是编工作流

大模型还在拼智商,高盛却把目光移开了。硅谷调研一圈后它给出判断:AI 已进入"执行时代",下一场战争在"工作流"——谁把模型编排进流水线,谁赢。 这篇把报告拆开,讲清楚为什么这个判断可能比任何跑分都重要。

高盛这次调研,结论很"反直觉"

事情要从一份调研总结说起。全球顶级投行高盛的人,跑去硅谷把 AI 圈扫了一圈,回来后抛出三个判断,这两天在腾讯、华尔街见闻等平台的科技榜上轮流转:

  • Agent 进入执行时代——AI 不再止步于"回答",开始"执行";
  • AI 竞争转向工作流——下一个胜负手不是模型本身,而是编排;
  • 世界模型崛起——让 AI 理解物理世界,不再只会处理文字。

前两条尤其值得细品。因为就在几个月前,所有人还在争论"谁的模型聪明",比的还是参数、跑分、上下文长度。高盛这盆冷水泼得相当直接:比模型,已经过时了。

"执行时代"到底是什么:从答题机到操盘手

先拆第一个判断。你过去用 AI,本质是"答题机":问一句,它答一句,答案好不好看运气。Agent 时代变了——它拿到一个任务,会自己拆解、规划、调用工具、执行、看结果、再迭代,直到把整件事干完。

背后是一套循环:目标拆解 → 规划步骤 → 调用工具(代码、浏览器、API)→ 执行 → 拿反馈 → 修正 → 收尾。模型只是这个循环里的"大脑",真正干活的是外面那一圈工具调用。

打个比方:以前你雇了个"问啥都懂"的顾问,现在你雇的是能自己跑腿、自己验收的员工。差别不在智商,在于它能不能把一件事从头到尾干完。这也是为什么"执行"两个字被高盛单独拎出来——模型推理能力早已不是稀缺品,"把事办成"的能力才是。

为什么说竞争转向"工作流":新护城河不在模型里

第二个判断最反直觉。明明各家还在卷模型,高盛却说竞争转向工作流。什么是工作流?简单说,就是把"拆任务→调工具→执行→验证"这一套,编排成可复用的流水线,让 Agent 按流程自主跑完。

这里有个容易被忽视的类比:PC 时代的操作系统。当年 CPU 性能差距并不决定一切,真正封王的是"谁的系统能把软硬件生态组织起来"。模型就像 CPU,工作流就像操作系统——模型会越来越同质化,而谁能把模型、工具、流程编排成好用的系统,谁就攥住用户习惯。你天天用的那套工作流跑顺了,不会轻易换,这就是护城河。

对开发者来说,这意味着机会点从"调一个更聪明的模型"转向"编一套更顺的流程";对普通人来说,AI 的使用方式也要升级——别再问一句抄一句了,试着把整件事交给它:整理数据、写初稿、做方案、跑流程,给它一个清晰的目标和步骤,让它自己干完。

第三块拼图:世界模型,给 AI 装上"物理常识"

高盛列的第三个趋势是世界模型。原理上,它要让 AI 不只理解文字,还能理解现实世界的规律——东西会掉落、车子会拐弯、人走过去会挡路。没有这套"常识",机器人只能在实验室里打转,自动驾驶也不敢放手。把世界模型和 Agent 接在一起,就是给"会干活的 AI"装上"看得懂现实的 AI"。这大概也是高盛把这两件事放在同一份报告里的原因:执行能力 + 世界认知,才是完整的下半场。

高盛这个判断不一定全对,但方向值得当真:AI 竞赛的比分牌,可能真的要从"谁的模型聪明"换成"谁能把事办成"了。

如果觉得今天这篇有启发,点个在看,顺手转发给需要的朋友;想第一时间收到推送,可以星标我⭐。

关注我,每天陪你聪明看世界 —— 看懂热搜,玩懂AI。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

深频率

没赞的日子,我像断了WiFi。

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值