什么时候该把一个 Agent 拆成两个岗位

2026-08-25

我手上有一个已经跑起来的 Agent,负责写公众号文章。它跑通的链路是完整的一条:从飞书收发消息开始,做选题分析、跟我确认写作方向、确认提纲、核验资料、写正文、生成封面,最后把成果结构化地保存到本地。这条线上唯一还没接通的是往公众号草稿箱写入这一步,所以它的交付终点现在是「文章和封面已经生成并保存好」,不是「已经进了草稿箱」。

后来我自己听播客、看视频的时候想记笔记,就冒出了第二个需求。

当时第一反应是:给现在这个 Agent 加一路输入就行了。音视频进来先转成文字,转完之后走原来那套——提纲、正文、成稿,现成的都能复用。听起来很省事。

我没这么干。下面是我用来判断的两个问题,以及为什么我认为它们比「能不能复用」更靠谱。

别问能不能复用,先问输入是不是同一种东西

第一个问题:这两件事,喂进去的东西是同一种形态吗?

写文章那个岗位,它的岗位卡里「输入」是单独一段,写死的是文章链接或者主题。这两样虽然长得不一样,但本质上都是文字,都是「一个待展开的题目」。

转录那件事,喂进去的是一段音频或者视频。它不是一个待展开的题目,它是一份已经存在、只是形态不方便检索的内容。

形态不同带来的差别不在技术上,在于判断的起点变了。写文章的流程一开始就要判「这个选题值不值得写」,判据是三个硬门槛:有可靠依据、能解释深层机制、不是常识复述,三条缺一就换角度或者放弃。可我听一期播客要记笔记的时候,根本不存在这个判断——内容是给定的,我没有选择要不要写它的余地,我只是要把它变成我以后用得上的东西。

第一个判断点就没有对应物,后面接着复用的想法就该打个问号了。

第二个问题更硬:做对了的样子是不是同一件事

我这套岗位卡里,「成功标准」是独立的一段,而且写法不是一列目标,是**「做对了」和「做错了」两组对照**。做错了那一组里有一条挺特别:未经过我的确认便直接公开发布文章——也就是说,流程违规本身被算作失败,跟内容质量并列,不是内容好就能抵消。

现在把两边的「做对了」摆在一起看:

写文章这边,做对了意味着交出来的是一篇能发的文章。所以它的判断点全都长在「文章」这个产物上——提纲要过删除测试(删掉这段之后读者会不会失去重要认知或行动依据,不会就删)、正文要有真人感、标题不能对正文做不到的事打包票、封面要合格。

记笔记这边,做对了意味着我以后翻回来还能用。它不需要真人感,不需要标题吸引谁,不需要封面。

这两组标准之间,没有一条是共用的。

我把这个当成分岗的主判据:输入形态不同只是提示,成功标准不同才是定论。两个活儿如果最后是拿同一把尺子量的,那它们是一个岗位的两条输入路径;如果得换一把尺子,那就是两个岗位。

还有个更直接的验法,比对照标准更快。我那个写作岗的岗位卡里,第二段是「一句话岗位定义」,只有一句:

当收到文章链接或主题时,自动分析素材、确认写作方向、完成文章和封面,并保存到指定目录及微信公众号草稿箱。

(说明一下,这句话里的「草稿箱」写的是目标态。前面提过,草稿箱写入这一步至今还没接通,现实中的交付终点停在保存到本地目录。岗位定义写的是要到哪儿,不代表已经到了。)

这一句里压了三样东西:什么时候触发、处理到什么范围、交到哪儿算完。验法就是:给你的新需求也写这么一句,然后试着把两句话并成一句。 如果并出来的句子必须用「或者」把触发条件和交付终点各分两路,那它就是两个岗位被硬塞进一个壳里了。一句话定义的价值就在于它不允许你含糊:并不出来,答案其实已经有了。

落到动作上:先写第二张岗位卡,别先去接工具

判断完之后我做的第一件事,不是去找转录工具、不是去测哪个模型转得准,而是新建了一个目录,在里面写了一份岗位卡。到现在为止,那个目录里也只有这一份文件,工作流卡片还没产出,进度停在「正在分析流程阶段」——也就是还在拆工序。

先写卡不接工具,理由和上面那两个判据是一回事:工具能不能转、转得准不准,是这个岗位的实现问题;而它的输入是什么、做对了长什么样、哪儿必须我来点头,是这个岗位存不存在的问题。后者没想清楚就去接工具,最后接出来的东西属于哪个岗位都说不上。

我那张岗位卡的结构是八段:岗位名称、一句话岗位定义、输入、处理动作、输出、成功标准、人工兜底、本期不做。其中六段每一次都得逐字重新想——岗位名称只是个标签,人工兜底和本期不做说的是同一件事的两面,这两处不用每次都重来。

这个「六段要重想」是拆岗成本的实际来源。多一个岗位,不是把老卡复制一份改改名字,是六段全部重新过一遍:新的输入怎么算合格、新的输出是什么形态、做错了都有哪些样子、哪些异常要我人工接手、这一期明确不做什么。

「人工兜底」那一段在我这里是分两类写的:介入条件 是异常触发,检查环节 是常规必经。写作岗的检查环节只有三条——选择写作方向、确认提纲和主要观点、审核最终正文与封面并决定是否公开发布。

这三条我一条也搬不到转录岗上。前两条锚在「一篇待写的文章」上,第三条锚在「要不要公开」上。一份自用笔记不存在这个位置。检查环节是我这套流程里唯一一处强制停下来等人的地方,它一条都对不上,就说明这两个岗位连人该在什么时候介入都不一样。

到这里再回头看「加个分支就行」这个念头:它省下的是接工具的功夫,代价是把两套成功标准、两套人工介入点混在同一张卡里。这笔账我算下来不划算。

边界:这两条判据什么时候不该用

第一种不适用的情况:输入形态不同,但成功标准相同。这时候不拆。

我那个写作岗自己就是例子。它的输入既可以是一条链接,也可以是一个纯主题,形态明显不一样——链接要去抓原文、可能抓不到,主题要先问清楚写给谁看。但这两条路最后交出来的是同一种东西,用同一把尺子量,所以它们归一个岗位。

差异被吸在工作流的第一个判断点里,那个判断点就叫「输入是否足够开始」。异常也各有各的出口:人工兜底的介入条件里,链接不可访问或者需要登录付费是一条,主题或目标读者不明确是另一条。同一个岗位里放两种输入形态是正常的,前提是它们汇到同一个成功标准上。

第二种:你还说不清「做对了长什么样」的时候,先别拆。

这时候你缺的不是一个新岗位,是那一句岗位定义。先把那句话写出来,写不出来说明这件事你自己还没想清楚要什么,拆出去的也只是一个空壳。我记笔记那个需求,起点其实很土——就是我自己听播客看视频想记笔记,先有这个,才有后面的判断。

第三种:这条判据本身的样本很薄。

我这边真正跑完整条链路的岗位只有一个。第二个岗位停在岗位卡这一步,工作流卡片、执行档案、踩过的坑,一样都还没有。也就是说,「拆成两个岗位是对的」这个结论,目前只被前半程支持——我确实按两套标准分开写了卡,但它还没跑到能反过来验证这个决定的阶段。

所以这两条判据现在的位置,是「我用来做决定的问法」,不是「已经被结果证明有效的规则」。等第二个岗位真正跑起来、踩出自己的坑之后,我可能会回来改它。

这篇的判据来自我自己带 Agent 干活的实践,样本有限。它更像一份可以拿去验证的假设,而不是一份可以照抄的规范。

延伸阅读

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。