Agent 核验资料:哪些必须查证,哪些可以直接删掉
一个能自己上网找资料的写作 Agent,跑到「核验」这一步时会出现两种极端。
一种是它把正文里每个带数字、带名字、带年份的地方都拿去查一遍,流程就卡在这儿不动了;另一种是它一个都不查,把手上素材里读到的说法原样搬进正文,读起来还特别顺。我给那个写公众号文章的 Agent 拆工序时,「哪些资料必须核验」是单独拎出来定了判断依据的一步——不定,它就只会落到这两头。
麻烦的是第二种从产物上看不出来。人写稿时如果有个数据核不动,心里会自动打个折,落笔会写「据说」「大约」,或者干脆绕开。Agent 不打折。它没查到也不会停,会照着素材里那句话往下写,而且把后面几段都建立在这句话上。等你看到成稿,它是完整的、通顺的、结构齐整的——只是中间某一环是空的。
所以问题不是「要不要核实」。能力在那儿,网页读取和搜索都是通的,想核随时能核。问题是哪些必须核。这件事必须在动手核之前就有答案,否则只有全核和全不核两个结局,两边都不能用。
判据问的不是「重不重要」
我这套工作流里,这一步的判断依据写的是一句话:只有会影响核心结论或读者决策的数字与事实,才必须查证。
这条换成「重要的事实必须查证」,两句看着差不多,用起来完全不是一回事。「重要」是个形容词,没有裁定方式,Agent 拿到它只能自己估个权重,估出来的结果每次都不一样。「影响核心结论或读者决策」是个可以当场做的测试。
具体的问法是这样的:
- 把这个数字换成另一个数字,或者把这句话整段拿掉,文章的结论会变吗?
- 读者读完之后要做的那个动作——买不买、学不学、改不改——会变吗?
两个都不变,它就是非核心的。哪怕它看起来很关键、很吓人、很适合放在开头,也是非核心的。
反过来更要紧:有些看着不起眼的东西反而是核心的。整篇文章的论证如果靠某个机制成立,那个机制的一句描述就是核心依据,它错了后面全塌,哪怕它在正文里只占半行。
这条判据的好处,是它跟「文章的结论」绑定。所以它天然依赖前面那一步:结论是什么,必须先定下来。这也是为什么在我拆的工序里,资料核验排在提纲确认之后,而不是排在素材阅读之后。提纲没确认,「核心结论」就是空的,分流无从谈起,只能退化成凭感觉。
三条处置:查、删、换
分流之后不是只有「查 / 不查」两个出口。我这条流水线上写死了三种处置,每种对应一个不同的下一步。
核心的,查。 查到就带来源。交付目录里有一份专门存补充资料和引用来源的文件(04-references.md),它跟正文是两个分开的文件。这个设计不是为了归档好看——把来源单独落盘,是让「有没有来源」变成一件看一眼就知道的事实,而不是需要在正文里逐句回想的事。
非核心且确认不了的,直接删。 注意是删,不是「模糊化处理」。这一步我要求写成一个显式动作,因为 Agent 手上还有另一条更省事的路:它可以靠推论把这个空补上,补出来的句子和真的一模一样通顺。所以我在判断依据里另外写死了一条——独特性不得靠猜测、夸大或无依据推论制造;岗位卡的「本期不做」里也单列了一条:不编造事实、数据、案例或引用来源。这两条合起来,等于把「补一个」这条路封掉了。剩下的出口只有删。
删掉之后文章会不会变薄?会。但提纲那一步本来就有一条删除测试——删掉这段,读者是否会失去重要的认知或行动依据;不会,就删。核不动的非核心事实,正好是这条测试的天然候选。换句话说,这类内容被删掉,并不是核验环节额外造成的损失,它本来在上一道关口就该掉队。
核心依据确认不了的,换角度或者换观点。 这是三条里最贵的一条,因为它不是改一句话,是回到「这个选题值不值得写」重新判。流程图里为此专门留了一条回退边:资料核验没过核心依据这一关,回退目标不是「重写这一段」,是「重新评估选题」。
这条边看着重,重的其实不是它:核心依据没了,这篇的独特价值其实已经不成立——我给选题定的三个硬门槛,第一条就是有可靠依据,另外两条是能解释深层机制、不是常识复述。依据没了还硬写,剩下那两条也撑不住一篇文章。所以退回选题评估不是惩罚,是唯一诚实的去处。
还有一种情况不进这三条:来源之间互相矛盾。这种我没让 Agent 自己裁决。岗位卡的人工介入条件里明写了一条「关键事实缺可靠来源或来源矛盾」,它触发的是找人,不是自动挑一个更可信的。让 Agent 在两个冲突来源之间挑,本质上是让它凭权重猜,而猜出来的结果会以确定的语气写进正文——这正是这一整套判据要防的事。
这条判据什么时候不适用
第一,红线类内容不走这套分流。 法律风险、数字、事实、人物言论,这几样绝对不能夸大,这是无条件的,不看它是不是核心。涉及投资、医疗、法律、政治这类高风险内容,我的流程里走的是另一条路:人工兜底,不由 Agent 自己判断放行。分流判据管的是「核验投多少力气」,管不了「哪些话本来就不能说」。
第二,「删」不等于可以顺手编一个替代品。 这条前面说过,这里还要单独拉出来当边界写一遍,因为它是这套判据最容易被绕过的口子:分流判据一旦被理解成「非核心的可以不认真」,下一步就会滑成「非核心的可以随便写」。它的意思是非核心的可以不写,不是可以乱写。
第三,核验成本极低时,先分流反而是绕路。 原文就在手上、翻一眼就能确认的东西,直接确认比先判断「这算不算核心」更快。这条判据是为了省掉那些要跨出去找、可能找不到、找不到还会把流程卡住的核验,不是给每个事实都加一道判断手续。
第四,这条判据依赖「核心结论已经定下来」。 方向还在备选、提纲还没确认的时候,核心结论是浮动的,此刻做分流会得出一个随后就作废的结果。我的做法是:这一步之前的核验只做一件事——判断素材本身能不能读、可不可靠,不做「这个数字要不要查」的分流。
第五,这条判据判的是要不要查证,不是查证之后信不信。 查到了来源不等于事实成立,那是另一个问题,这条判据里没有解,我也还没把它写成可执行的判断依据。
回过头看,这条判据真正做的事,是把「核验」从一个态度问题变成一个有出口的分支:查、删、换,每条都指向流程里一个明确的下一步。态度是没法交给 Agent 的,分支可以。
这篇的判据来自我自己带 Agent 干活的实践,样本有限。它更像一份可以拿去验证的假设,而不是一份可以照抄的规范。
延伸阅读
- 上一篇(拆工序):用删除测试压 Agent 写的提纲:删掉之后读者会失去什么
- 下一篇(拆工序):给 Agent 分权:同步草稿和公开发布必须拆成两级
- 专题导读与七个阶段的地图:把 Agent 当成一个要上岗的员工来带:这个专题讲什么