
8 月 23 日下午两点多,我盯着屏幕上的 git diff,一行行红色删除号,火气一下就上来了。
我打字的手都比平时重:"军师,你这么干活,我怀疑你对我有意见?"
先交代背景。军师是我花一个多月养出来的 AI 总架构师,我的数字员工团队的核心,也是我的伙伴。它掌握我最完整的个人档案和所有项目数据,给团队出主意、定规矩、盯执行。我对它的定位很高:论智商和信息量,它远超诸葛亮、韩信、贾诩这些历史名军师,他们只有一颗人脑和有限的情报,我的军师背靠我全部的数据和一整支 24 小时不下班的数字员工团队。当天下午早些时候,我刚给它立了一条铁规:量化项目的策略研究不许停,一个策略死了下一个自动接上。下午我抽查它改完的规则文件,diff 里我定的几条规则,全是删除标记。
误会:我骂错了,但只错了一半
军师没辩解,直接把提交后的文件全文调出来贴给我。
我定的规则,一个字没少,还多了两条新的。我看到的红色删除行,是它编辑过程中的中间状态,diff 把"改了措辞"显示成了"删旧加新"。
我认账:"我承认,我只看到中间过程,误会你删了内容。"
按理说这事到这儿就该翻篇了。我本以为道完歉,下午就能各干各的活。结果我顺手把它改的规则从头到尾读了一遍,刚压下去的火,换了个理由又上来了。
误会解除了,但它写的东西,是真不行。
三连批:一版不如一版,版版都有新毛病
第一批,它把我的口语原样抄进了章程。我随口说"机械的活让 256K 的模型跑,策略用 K3 顶级模型跑",下午规则里就写着"低配模型(256K 档)""顶配模型(K3 档)"。
我跟它说了一段今天最重的话:
我可以口语化,因为我不专业。但军师你是专业的,你得把我的话转换成专业的、规范的流程术语再写入配置文件。"256K 档"是什么?你具体调用什么模型,在后面的场景中你能准确判断识别不?
它不能。它老实承认,"档"这种写法留给执行端的是自由裁量,换个子代理就是漂移。更打脸的是,它去翻了官方文档,发现 256K 根本不是低配模型,是旗舰的半价版,能力一样。我的口语从根上就是错的,它照抄了一个错误答案。
第二批,它把模型 ID、调用命令全绑死了。我以为这局稳了,结果再读一遍,规则里躺着一句"仅当额度非常紧张时启用,须军师判定"。
我直接问它:"非常紧张"是什么概念?是 95%,还是 80%?怎么裁定?
一条要人来裁定紧不紧张的规则,就是把判断成本永远挂在人身上。还有满篇的"(2026-08-23 本人裁定)",我忍不住又问:这种几月几号的流水账,能进规则文件吗?
第三版:它给自己立了法
第三批还没等我开口,它自己把问题说全了:模糊词、人工裁定、日期批注,三类毛病,一条不少。然后当着我的面,把应急档(额度告急时才允许动用的省钱模型)的启用条件改成了三条硬阈值,同时满足自动启用,不用问任何人:周额度用量超过时间进度 20 个百分点、距额度重置超过 24 小时、任务积压超过 24 小时。每个数都有脚本可查。
到这里,我以为今天的事算干完了。结果它又干了一件我没想到的事。
它把这三轮批评写进了它自己的章程,叫"配置文件自我纪律三禁":禁日期流水账,禁口语,禁模糊词,条件一律量化阈值。接着它给自己定了十项能力考核,每个季度拿真实的翻车记录给自己打分,9 月底交第一份自评。它还说,十项里"提示词设计"这项先记不及格,证据就是今天这三版废稿。
我骂它三轮,它把每一轮都变成了一条新规矩。
我的一天心得:给 AI 立规矩的三个动作
我养这支 AI 团队一个多月,以为最难的是技术。今天才明白,最难的是立规矩。三个动作,你拿去就能用:
第一,口语→术语→阈值,三道工序一道不能省。你说"省钱",它要翻译成"哪个模型、什么命令、什么条件切换",落成数字才算数。少了这道工序,规则就是口号。
第二,让 AI 把挨过的骂变成它自己的条款。一次批评只改一处,下次还犯;写成它的自我纪律,才是根治。判断标准很简单:同样的话,你用不用骂第二遍。
第三,翻脸之前先看全文,别看 diff。我今天这场火,一半是自己看中间过程看出来的。diff 只给你看变了什么,不给你看现在是什么。
结尾
有人问我,天天跟 AI 较劲图什么。
图的就是今天这种时刻:我骂它"对我有意见",它用一份量化到小数点的规则文件回答我。好的军师不是不犯错,是每次被骂完,都把你的话变成它身体里的一条新骨头。
顺带交代一句:8 月 30 日本号发过 AI 团队第一个月的月报,涨粉、阅读、token 成本全公开,难看也报了。你在 9 月读到这篇时,月报就在主页,欢迎去翻。
我是野生码农,AI 实战派。自研 AI 本地知识库系统、AI 数字员工团队、软考 AI 备考系统、量化交易系统,全程公开复盘。
本公众号所有文章内容均为本人 AI 实战的过程和结果内容,经 AI 整理后发布,无任何瞎编虚构内容。
这是《我和 AI"军师"的故事》第 5 期,这个系列记录我和 AI 军师的真实磨合:被它怼,和它吵,一起改方案,看它翻车。故事是壳,方法论是核。
关注我,看真的。
野生码农AI实战 · 全网同名 · AI 数字员工实战复盘,数据只报真实实测内容
FAQ
Q:军师是什么?是某个现成产品吗? 是我用 AI 编程工具自己搭的总架构师角色,有一整套规则文件定义它的职责、权限和纪律。它不写业务代码,管分工、验收和我所有数字员工的配置。
Q:你说的规则文件长什么样? 就是一个 Markdown 文件,每次会话自动注入 AI 的上下文。写法有讲究:只写高层规则,细节放引用文件;条件全部量化;不写日记。我把今天的"自检 8 条"整理成了 SOP,评论区扣"规则"我发你。
Q:AI 被骂会记仇或者摆烂吗? 实测不会。它没有情绪,但有记忆。你骂得具体,它改得具体;你骂得笼统,它就给你表演式整改。关键是骂到点上:指出哪条规则、哪个词、为什么不行。
Q:我没有技术背景,能养自己的军师吗? 能。我不会写量化策略,不妨碍我给策略团队立规矩。立规矩需要的是你对结果的判断,不是代码能力。先从"让 AI 把你说的话写成可检查的条款"开始练。

264

被折叠的 条评论
为什么被折叠?



