Agent 的判断点要成对写:怎么判,和为什么这么判
我给 Agent 写工作流的时候,有一段时间写得特别顺手:把每个需要判断的地方列出来,标准写清楚,一二三四,条理分明。看着挺专业。
然后就开始出事。
出事的地方从来不是我写到的那些情况,而是我没写到的。规则里说”关键数字必须核验”,Agent 遇到一个人物的头衔,卡住了——这算不算关键数字?它不知道。它要么停下来问我(那我这自动化白做了),要么自己拍一个(拍对拍错全看运气)。
规则永远覆盖不全。 这不是我写得不够细,是这件事本身就做不到。你写一百条,第一百零一种情况照样会出现。
所以后来我改了写法:每一条判断都写成两段——判断点和判断依据。前一段说怎么判,后一段说为什么这么判。
一个检验依据写没写到位的土办法
补依据这件事,说起来容易,写起来很容易糊弄。写成”因为这样比较好”那种,等于没写。
我用的检验方法很土,但挺管用:
把「怎么判」那一段盖住,只留「为什么这么判」。一个没见过这条规则的人,能不能靠这段依据自己推出那条规则来?
推得出来,说明依据写到位了——它捕捉到了规则背后的那个东西。推不出来,说明你写的是一句同义反复,或者干脆是”我就想这么定”。
这个检验有个副作用:它会逼你面对一件事——有些判断你其实说不出依据,纯粹是偏好。 这没什么丢人的,但你得老实写成”这是我的偏好,没有更深的理由”,而不是硬编一个听着很有道理的解释。硬编的那种最坏,因为 Agent 会拿那个假依据去推别的情况。
落到我那张卡上:三条实际的例子
我那个写作 Agent 的工作流卡片里有十二个判断点,每一条都是这么成对写的。挑三条说说效果。
第一条,哪些资料必须核验。
判断点写的是:会影响文章核心结论或者读者决策的数字和事实,必须查证。 依据写的是:关键数字或事实出错,会损害文章可信度和账号信任。
有了这句依据,前面那个”人物头衔算不算关键数字”的问题就有答案了。Agent 可以自己往下推一步:这个头衔如果写错,会不会损害可信度?会,那就查。相反,如果是一句”某地天气不错”这种顺带提一句的描述,错了也不影响任何人的判断,那就不必占用核验的时间。
规则没有列举这两种情况,但依据能把它们都算出来。
第二条,选题值不值得写。
判断点是三个硬门槛:有可靠依据、能解释深层机制、不是常识复述。三者缺一就换角度或者放弃。 依据是:专业可信的观点必须同时具备事实基础、解释力和差异性。
这条依据的价值在于它解释了为什么是三个,而不是随便凑的。三个门槛正好对应依据里的三个词,一一对上。所以当我以后想加第四个门槛的时候,我得先问自己:它对应依据里的哪个词?对不上,说明我是在往上堆规则,而不是在完善判断。
第三条,最终质量检查怎么做。
判断点是:采用固定的红线清单扫描,不要求每篇文章都去查渠道的最新规则。 依据是:固定红线能以较低成本覆盖常见的重大风险。
这条我最喜欢,因为依据里藏着一个明说出来的取舍。它承认了这套做法会漏——渠道出了新规则,固定清单是不知道的。写出来之后,我心里就有数了:这道门是拿覆盖率换成本的,那我得另外安排一个动作,隔一段时间人工更新一次清单。
如果只写规则不写依据,我大概率会忘了这里有个洞,然后某天被新规则撞一下才想起来。
三种写了等于没写的依据
补依据这件事,糊弄起来毫不费力。我自己写废过不少,归纳下来是三种。
第一种,同义反复。 规则说”关键数字必须核验”,依据写”因为核验关键数字很重要”。这就是把规则换个说法又说了一遍,一个字的新信息都没有。
第二种,万能理由。 依据写”为了保证内容质量”。这句话放在哪条规则底下都通顺——放在”标题不许夸大”下面通顺,放在”封面不许用来路不明的图”下面也通顺。能到处套的理由,等于没有理由。
第三种,编出来的因果。 依据写”因为读者更喜欢这样”。可你没问过读者。这种最坏,因为它长得像一条经验事实,Agent 会拿它当真去推别的情况,推出一串你根本不同意的结论,而且每一步看起来都很有道理。
检验这三种的办法,跟前面那个是一对:把这句依据抄到另一条完全不相干的规则底下,如果照样读得通,那它就是废的。 好的依据是长在这条规则上的,挪走就不成立。
还有一个没料到的好处:依据是写给未来的自己看的
这条我是过了几个月才体会到的。
规则会被改。你自己会改,你也会让 Agent 帮你改。改的时候,如果只有规则没有依据,你看着那条规则会觉得”这写得也太死了吧”,然后顺手放宽。放宽的那一刻你已经忘了当初为什么定这么死。
依据那一栏就是拦这个的。它把当初的理由钉在旁边,改之前你至少得先跟那句话对上话。
我现在改任何一条规则,习惯是先看依据:依据还成立吗? 成立,那规则不能动,动的话得先证明有更好的实现方式。不成立了(比如场景变了、工具换了),那规则自然该改,而且要连依据一起改掉。
什么时候这条不适用
三种情况我会跳过成对写:
一是纯粹的格式约定。 文件叫什么名、字段按什么顺序排、日期用哪种格式——这些没有依据可讲,就是约定,写依据反而是凑字数。
二是依据比规则还难懂的时候。 我试过给一条判断写依据,写出来自己都绕,那说明我还没想清楚。这种时候老实承认”暂时说不清,先按这个执行,等想明白了补上”,比编一个玄乎的解释强。编出来的依据会被 Agent 当真去推理,推出来的东西你控制不住。
三是这条判断只会命中一次。 一次性的特例,写成规则就行了,它没有推广的需要。
最后说一句边界:这个做法的成本是实打实的。十二个判断点,每条多写两三句,加起来是一整段的工作量,而且写依据比写规则费脑子——你得真的想清楚为什么。我认为值,但这是我的判断,不是一条普适的性价比结论。 如果你的 Agent 只跑固定的几种情况、几乎不遇到边界,那这笔投入大概率收不回来。
这篇的判据来自我自己带 Agent 干活的实践,样本有限。它更像一份可以拿去验证的假设,而不是一份可以照抄的规范。
延伸阅读
- 下一篇(拆工序):Agent 工序的边界该切在哪:三类位置
- 专题导读与七个阶段的地图:把 Agent 当成一个要上岗的员工来带:这个专题讲什么