给 Agent 定目标:内部目标和对外承诺是两套口径

2026-08-25

我给那个写公众号文章的 Agent 写过一份岗位卡,成功标准那一段是照着「我希望它把事情干成什么样」写的,里面放了流量方向的目标。后来我又给同一个岗位补了一份对外说明书,讲清楚它能做什么、不能做什么,在「不做的事」里写下了另一句话:不能保证每篇文章成为爆款,也不能承诺阅读量、涨粉或转化结果。

同一个岗位,同一个人写的,两份文件对同一件事给了方向相反的表述。这篇复盘的就是这件事——我没有把其中一处改掉,而是最后确认了它们本来就是两套口径。

单看哪一份都没问题

岗位卡那段成功标准,单独读是一份合格线:它告诉 Agent 什么算干成了、什么算没干成。这个 Agent 的成功标准我不是写成一列目标,是写成「做对了」和「做错了」两组对照的,其中做错了那组里还有一条跟内容质量并列的流程条款——未经我确认就直接公开发布,这件事本身就算失败。所以那一段在我眼里一直是「验收用的」,我写目标的时候没觉得有什么不对。

说明书那句话,单独读也是一句本分的话。它跟「不编造事实、数据、案例或引用来源」「不洗稿或大段复制其他作者的内容」「不擅自处理和发布高风险内容」「不使用版权不明的素材」是并排列在一起的。放在那个位置上,它读起来根本不像目标的反面,更像一条行为约束。

矛盾是在两份文件之间的,不在任何一份文件内部。这就是它能长时间躺在那儿不被发现的原因。

我是把几份文档并排回读时才对上的

这一段我想写细一点,因为发现的方式比这个矛盾本身有用。

首先,它不是从产出上看出来的。这个 Agent 那段时间的产出是正常的,它按流程走、在该停的地方停下来等我确认,我对成品的评价是基本满意。文档之间的口径不一致不会让任何一步报错,也不会让任何一篇文章变难看——它只会在你哪天想把这套东西交给别人的时候突然变成问题。

其次,它是在跨文件的回读里冒出来的。岗位卡我是按八段结构写的:岗位名称、一句话岗位定义、输入、处理动作、输出、成功标准、人工兜底、本期不做,其中有六段每一次都要逐字重想(岗位名称只是个标签,人工兜底和本期不做是同一件事的两面,这两处不用每次重来)。八段之间彼此有分工,各写各的,我平时改岗位卡是按段进去改的,很少整份读完。说明书更是另一份文件,通常是要拿给别人看之前才打开。这两份东西平时根本不在同一个视野里。

具体是哪一天翻到的我没有记录。但触发条件我记得:是把这个岗位的几份文档摊在一起、从头到尾按段过一遍的时候。这个动作我现在会定期做一次,它抓到的东西和逐份检查抓到的完全是两类——逐份检查抓的是这一份里有没有写漏,并排回读抓的是几份之间有没有在打架。

为什么这两套口径可以并存

想明白之后我发现,它们根本不在同一个语义层上。

内部那段目标,作用是给努力定方向。Agent 干活的时候要在很多地方做取舍,取舍要有一个朝向,否则它每一步都合规、但整体不知道往哪走。这个朝向必须写下来,而且要写得具体到能对齐,光写「写好文章」是对不齐的。

对外那句不承诺,作用是管别人的预期。它管的不是 Agent 怎么努力,是我怎么对外表述这件事能到什么程度。它跟「不编造事实」是同一类东西——都是「不许说什么」,不是「要做到什么」。

这两件事一旦混着写就会双向出事。把内部目标当对外承诺讲出去,等于替一件自己控制不了的事打包票;反过来,因为对外不能承诺就把内部目标也删掉,Agent 就失去了取舍的朝向,只剩一堆不许做的事。

而且这里有一条更具体的分界。在这个 Agent 的工作流里,「承诺」是有兑现路径的东西:标题可以适度强化吸引力,但正文必须兑现标题给出的承诺;法律风险、数字、事实、人物言论绝对不能夸大。这条判据在流程图上还挂着一条回退边——标题给出的承诺在正文里找不到支撑,就退回去重新优化标题。也就是说,凡是能被写进承诺的东西,都得有一条能退回去修的路。

而结果类的东西没有这条路。写完之后往回退,退到哪一步能把结果修好?没有这样一步。它不在 Agent 的动作范围里,也不在我的动作范围里。承诺一件退不回来的事,本来就不成立。

我后来怎么分开管这两处

我没有让两份文件的表述统一,做的是把它们的边界写清楚,还有三条自己的规矩。

一是内部目标只留一个主指标,其余的降成辅助分析,不并列成一排硬门槛。多个指标摆在一起,方向不一致的时候没法判,最后会变成挑一个对自己有利的说。定成一主多辅之后,判断有唯一入口,辅助的那些只用来解释为什么,不参与判成败。

二是内部目标不外流。写对外材料的时候,涉及结果的部分我用的是保底写法——连指标名都不出现,只说做到哪一步为止。我给这个 Agent 的交付终点定的是「文章和封面已生成并保存」,草稿箱写入这条链路到现在还没接通,所以我对外说的也就到这儿,不往后多说一格。目标是我自己的事,承诺是别人会拿去当依据的事。

三是发布权单独留给人。这个 Agent 的流程里定死的权限规则是:审核通过之后同步草稿可以自动做,不用再问我;但公开发布必须我确认,确认之后才走发布。这是权限怎么分级的规定,不是说这条链路今天已经在自动跑了——上面说过,草稿箱那一段至今没接通。规则先写在这儿,等接通了照着走。同步草稿和公开发布就这样被拆成了两个权限等级。这条设计当初不是为了这篇讲的问题设的,但正好把口径的事兜住了:对外承诺的那一刻是人做出的,不是 Agent 做出的。Agent 只负责把内部目标当朝向去干活,它没有对外说话的权限。

从这一次里我带走的一句话

一段目标文字写下来之前,先问它会被谁读到、读到的人会不会把它当成承诺。

这句话对 Agent 比对人更要紧。人看到一段目标,知道那是期望;Agent 拿到的成功标准是判据,它会照着判据决定取舍、决定什么时候算干完。所以给 Agent 写的目标必须够具体,具体到能指导取舍——而恰恰是「具体」这件事,让它一旦被搬到对外的文件里就变成了承诺。同一段字,在内部是判据,在外部是承诺,这就是它必须分成两份文件写的原因。

我现在给新岗位写卡的时候,成功标准和对外表述是分两次写的,中间隔开,写完再并排读一遍。这个动作花不了多少工夫,但它是我目前唯一能稳定抓到跨文件矛盾的办法。

这篇写的是我自己那套流程里的一次实际情况,不是通行做法。你的场景、工具和团队规模不同,结论未必适用,判断方式可能比结论更值得拿走。

延伸阅读

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。