让 Agent 判断选题值不值得做:三个硬门槛
给一个 Agent 扔过去一条链接或者一个主题,它几乎不会拒绝。它会开始拆材料、给方向、列提纲、动笔,一路很顺。等你看到正文的时候才发现问题:这篇东西没什么可写的——支撑它的那个关键说法查无出处,或者说了半天都是读者本来就知道的常识。
难受的地方在于,这时候返工的不是一段文字,是整条链路。方向定了、提纲确认过了、资料也检索了一轮,全部得推倒。我这条流水线上,工序切分的一个依据就是「失败之后回退目标不同」,而选题这一步的回退目标是最靠前的那一个——一退就退到起点。
所以我在写公众号文章那个 Agent 的工作流里,把「选题是否值得写」单列成一个判断点,并且给它配了三条能当场判定的门槛。不是「判断选题质量」这种说了等于没说的表述,是三句话,问完就有答案。
三句当场能问出口的话
原判据是这么写的:有可靠依据、能解释深层机制、不是常识复述;三者缺一即换角度或放弃。
写成给 Agent 执行的问法,是这三句:
第一句:支撑这篇的关键说法,现在能指出它来自哪里吗? 注意问的是「现在」。不是「应该能查到」,不是「大概率是这样」,是此刻能不能指出来源。指不出来,就当作没有——不是先记着回头补,因为回头补的那一步大概率排在提纲之后,那时候已经晚了。
第二句:除了「是什么」,能不能说出「为什么会这样」? 这一句在挡的是只有现象没有机制的选题。素材里有一堆事实,把它们排列整齐并不构成一篇值得读的东西。能不能往下解释一层,是这一步就要判的,不是写到一半再看能不能编出来。
第三句:把这篇的结论压缩成一句话,读者在点开之前是不是已经知道了? 已经知道,就是常识复述。这一句最容易自欺,因为素材看多了会产生「这个观点很有意思」的错觉,而实际上有意思的是素材的组织方式,不是结论本身。压成一句话是个很粗暴但有效的动作,压完就藏不住了。
三者缺一即换角度或放弃——这后半句和前半句一样重要。判据只写「怎么判」,Agent 判出「不合格」之后仍然会继续往下走,因为它不知道除了往下走还能干什么。所以出口必须一并写死,而且写了两个:换角度,或者放弃。这两个出口对应的是两种不同的不合格——素材本身还行只是切入点选错了,和素材本身就撑不起来。
为什么是这三条
这三条不是随手凑的,它们各挡一层:事实基础、解释力、差异性。
事实基础决定这篇能不能写——依据不成立,后面全是沙上建塔。解释力决定这篇值不值得读完——只有事实没有机制,读者扫一眼就走。差异性决定凭什么由你来写——机制解释得再清楚,如果是人尽皆知的机制,这篇的存在没有理由。
顺序也有讲究:从「能不能」到「值不值」到「凭什么」,是一层层往外扩的。前一条不过,后面两条不用问。
那条给第三关上的锁
判断点里还跟着一条约束,原文是:独特性不得靠猜测、夸大或无依据推论制造。
这一条挂在第三个门槛上,因为差异性是三条里最容易伪造的。一个想让选题通过的 Agent,最省力的做法就是把一个平常的判断说得更绝对一点,或者补一个听起来顺理成章但没有依据的因果链条——这两种操作立刻就能造出「不是常识」的表象。
但这种伪造有个自毁特征:靠推论造出来的独特性,本身就没有可靠依据,也就是说它同时把第一个门槛给废了。所以这条约束不是第四个门槛,它是防止三条门槛之间互相拆台的一道锁。三条门槛之所以是「三者缺一」而不是「满足其一即可」,原因也在这——它们不是并列的加分项,是必须同时成立的约束,任何一条被绕过,另外两条的判定结果都不可信了。
判据要跟判断点写在一起
这三条门槛在我的工作流卡片里不是孤零零挂着的。那份卡片里的每一个判断点,都写成「判断点 + 判断依据」两段:上面写怎么判,下面写为什么这么判。
这个成对写法,是我从这份卡片里拿走的最通用的一样东西。只写「怎么判」的卡片,一遇到卡里没穷举到的情况就失效了,Agent 要么卡住要么乱来。补上「为什么这么判」,它在边界情况下才有可能做出跟你一致的决定。放到这三条门槛上就是:判据告诉它问哪三句,判断依据告诉它这三句分别在挡什么——于是它遇到一个「依据来自一份口径不明的转述材料」这种卡里没写的情况时,知道该往「事实基础」那一层去靠。
另一处落到具体动作的地方,是不合格之后的回退目标。我那张流程图里有一条回退边,标的是:核心依据无法核验时,退回「评估选题价值」。它没有退到「撰写正文」,也没有退到「生成提纲」——因为依据塌了不是写法问题也不是结构问题,是这个选题该不该做的问题。回退边指向哪里,其实就是在声明这个失败属于哪一层。这一点值得单独检查一遍:一条画错方向的回退边,会让 Agent 在错误的层面上反复返工,而且每次看起来都在认真干活。
想加第四条门槛时,先问自己三句
用一段时间之后,你会很想再加一条。我的做法是先拿三句话拦一下:
这条在挡一种新的废稿,还是在描述前三条已经挡掉的东西? 大部分想加的第四条,仔细看都是前三条的一个特例。特例应该写进「判断依据」那一段作为说明,不该升格成一条独立门槛——门槛多了,每一条都会被草草判过。
这条能不能当场给出「是」或「否」? 给不出来的,说明它是个抽象标准而不是判据。抽象标准放进卡里的效果,等于什么都没放。
不合格的时候,动作是什么? 如果答不上来,这条门槛判了也是白判。原判据之所以带着「换角度或放弃」,就是因为一条没有出口的门槛,在执行时会被自动降级成建议。
三句都过了,再加。多数时候过不了。
这三条什么时候不适用
产出物本身不以独特价值立身的时候不适用。 比如把一次操作过程存成档、把一份材料整理成可查的记录,这类东西的价值在于可查、准确、完整,不在于独特。拿这三条去卡它,会全军覆没,但它们该做还是得做。
把第一条理解成「每句话都要有出处」的时候会卡死。 我这条流水线上另有一条核验口径:只有会影响核心结论或读者决策的数字与事实才必须查证。选题阶段问的是「支撑这篇的关键说法」有没有依据,不是全篇。这两条要配着用,单拿第一条往严里执行,选题这一步会没有任何题目能通过。
它挡的是明显不合格,不替人做最终裁决。 我这套流程里,方向、提纲、终审三处都是人工确认的闸门,最终决定权在人手上。这三条门槛的位置在开工之前,作用是把撑不起来的选题挡在链路外面,省掉后面那一长串返工——它不负责判断一个选题好到什么程度,那个判断留在闸门上。
我只在文章类产出上验证过。 别的产出形态——代码、数据、图像——这三条是否成立,我没有做过,不清楚。
这篇的判据来自我自己带 Agent 干活的实践,样本有限。它更像一份可以拿去验证的假设,而不是一份可以照抄的规范。
延伸阅读
- 上一篇(写大脑):Agent 写的东西:哪些段落可以口语化,哪些必须严谨
- 下一篇(写大脑):用固定红线扫描,不要求 Agent 每次去查最新规则
- 专题导读与七个阶段的地图:把 Agent 当成一个要上岗的员工来带:这个专题讲什么