十一条流水线各产出什么:一张表配决策路径

2026-08-09

选流水线这件事,最常见的错误做法是打开 README 那张表,从上往下扫 Best For 那一列,看见「教程」两个字就停下。问题是「教程」在这张表里出现了两次,「产品演示」也出现了两次,这四个格子分属三条完全不同的流水线。按这一列选,撞车躲不掉。

这张表真正能用的是另一列。

先把表原样摆出来

README 的 Pipelines 一节给的是这么十一行:

PipelineWhat It ProducesBest For
Animated Explainer带调研、旁白、视觉、音乐的 AI 生成讲解片教育内容、教程、主题拆解
Animation动态图形、动态排版、动画序列社交媒体、产品演示、抽象概念
Avatar Spokesperson数字人主持的演示视频企业沟通、培训、公告
Cinematic预告片、teaser、氛围驱动的剪辑品牌片、teaser、推广内容
Clip Factory从一个长素材批量产出经过排序的短视频把长内容改造成社媒短片
Documentary Montage从 CLIP 索引的免费素材与开放档案语料库剪出的主题蒙太奇(Pexels、Archive.org、NASA、Wikimedia、Unsplash)视频随笔、氛围片、检索优先的 B-roll 剪辑、不用付费生成 API 的真实素材视频
Hybrid源素材 + AI 生成的辅助视觉用图形增强既有素材
Localization & Dub给既有视频加字幕、配音、翻译多语言分发
Podcast Repurpose播客高光转视频播客营销、音频波形视频
Screen Demo打磨过的软件录屏与走查产品演示、教程、文档
Talking Head以说话人为主的视频演讲、vlog、访谈

先说一句必要的提醒:这张表不是全集。 README 正文另一处写的是 “12 production pipelines”,而我们实读 pipeline_defs/ 数出 13 个 .yaml,实读 skills/pipelines/ 数出 12 个子目录。三组数字对不上,具体差在哪几条、哪一条流水线没进这张表,本批另有一篇专门讲,这里不展开。你只需要先接受一个前提:在这张表里没找到名字,不等于仓库里没有那条流水线。

另外,Best For 这一列是项目方在 README 里给出的定位说法,不是我们的选型推荐;下面的重排是我们按表格文字本身做的归类,也不构成对产出效果的任何判断。

三个可分辨的轴

把十一行按 What It Produces 那一列拆,会发现有三个轴是真正互斥、能用来做判断的。

第一个轴:素材从哪来。 这是差别最大的一条。Documentary Montage 明写素材来自 CLIP 索引的免费素材与开放档案语料库,点名了 Pexels、Archive.org、NASA、Wikimedia、Unsplash 五个来源,它的 Best For 里还有一句「不用付费生成 API 的真实素材视频」——这是整张表里唯一一处直接提到付费 API 的行。Animated Explainer 那行则明写是 AI 生成。Hybrid 走的是第三条路:源素材加 AI 生成的辅助视觉。而 Screen Demo(软件录屏与走查)、Podcast Repurpose(播客高光转视频)、Localization & Dub(给既有视频加字幕、配音、翻译)这三行,从描述本身就能看出输入是你自己手里的东西。表里没写来源的行(比如 Talking Head),这张表回答不了,别替它补上。

第二个轴:画面里有没有人,是谁。 只有两行涉及:Avatar Spokesperson 写的是数字人主持的演示视频,Talking Head 写的是以说话人为主的视频。这两行的产出物形态完全不同,别按 Best For 里的「企业沟通」「演讲」去区分。

第三个轴:你手里是不是已经有一条长内容。 Clip Factory 的描述是从一个长素材批量产出经过排序的短视频,Localization & Dub 是给既有视频加字幕、配音、翻译,Podcast Repurpose 是播客高光转视频,Hybrid 写的是源素材加 AI 生成的辅助视觉。这四行的共同前提是输入端已经有东西了,剩下七行的描述里没有这个前提。这一点在下面的决策路径里是第一个分岔,因为它能一刀切掉七行。

决策路径

按这三个轴倒推,选择顺序应该是这样的。

第一问:你手里已经有一条成片或长素材了吗? 有的话,先在改造类里选,不要去看生成类。只加字幕、配音、翻译,走 Localization & Dub;要从长片里切一批短的,走 Clip Factory;输入是播客,走 Podcast Repurpose;素材本身够用、只是想加点图形,走 Hybrid——它的定位原文就是「用图形增强既有素材」。这四条的区别在动作(翻译 / 切分 / 转形式 / 增强),不在题材。

第二问:没有现成素材,画面里要不要出现一个人? 要数字人主持,走 Avatar Spokesperson;要真人讲话为主,走 Talking Head。

第三问:没有素材、画面也不需要人,那你要的是解释还是氛围? 要把一件事讲明白,走 Animated Explainer——它是表里唯一一条把调研、旁白、视觉、音乐四件事同时写进产出物描述的流水线。要的是预告片、teaser、氛围驱动的剪辑,走 Cinematic。要的是动态图形、动态排版、动画序列这类没有具体拍摄对象的东西,走 Animation。

第四问:要不要真实世界的画面,又不想调付费生成 API? 那就是 Documentary Montage 这一行,它是表里把这个约束直接写进 Best For 的唯一一条。

至于录屏走查,Screen Demo 一行直取,没什么可犹豫的。真正需要花时间分辨的是 Animation 和 Screen Demo 都写了「产品演示」、Animated Explainer 和 Screen Demo 都写了「教程」这两处重叠——这两处只看 Best For 分不开,回到 What It Produces 那一列看产出物形态就清楚了:一个是动态图形、动态排版、动画序列,一个是打磨过的软件录屏与走查,还有一个是带调研、旁白、视觉、音乐的讲解片。三种产出物形态,Best For 里却挤在同两个词上。

表选完之后还得核什么

这张表只能帮你缩到一两个候选,它不是能力清单。真正说了算的是 pipeline_defs/ 下那条流水线自己的 manifest。

我们只完整读过其中一份——pipeline_defs/documentary-montage.yaml 的前 70 行,拿它当样本看看表里读不出来的东西有哪些:

  • 顶层有 stability: beta,这是 manifest 里一个显式的稳定性标记,README 的表格里没有这一列。
  • reference_input 段下 supported: false。这条流水线不接参考视频入口。这是一个可核实的能力边界,也是 README 表格完全体现不出来的信息。这个字段本批另有一篇专门讲,这里只提示:选型时值得先去 manifest 里查一眼你要的入口方式支不支持。
  • orchestration 段里 budget_default_usd: 1.00,低于 config.yaml 的全局默认 total_usd: 10.00,说明单条流水线可以自带更紧的预算;同段还有 max_revisions_per_stage: 3max_send_backs: 2max_wall_time_minutes: 60
  • extensions 四个扩展开关里,custom_scriptscustom_playbookscustom_skills 都是 true,只有 custom_toolsfalse——这条流水线允许你加脚本、加 playbook、加 skill,但不允许自定义工具。
  • required_skills 列了 8 条:1 个执行制片(pipelines/documentary-montage/executive-producer)、5 个阶段导演(idea / scene / asset / edit / compose)、加 meta/reviewermeta/checkpoint-protocol 两个 meta skill。

必须说清边界:以上全部只来自这一份 manifest 的前 70 行。 其余 12 份 manifest 我们没有读过,所以上面这些字段的取值不能往别的流水线上推——比如不要因为 documentary-montage 的 reference_input.supportedfalse,就认为别的流水线也不支持,或者反过来推断有几条支持。要知道另一条流水线怎么样,只能去打开它自己那份 YAML。

顺带说一句选型时容易多虑的地方:流程不是选型变量。 README 写的是每条流水线都遵循同一套结构化流程 research -> proposal -> script -> scene_plan -> assets -> edit -> compose,这套阶段流本批另有专篇。也就是说你在这张表上做的选择,选的是产出物形态和素材来源,不是工作方式——工作方式十一条是一样的。

还有成本。这张表里没有成本列,README 别处给演示视频和示例 prompt 标了金额,那些都是项目方在 README 中自行标注的数字,不是我们验证过的报价,也和「你选哪条流水线要花多少钱」之间不存在换算关系,别拿来做选型依据。

什么情况下这张表帮不上忙

两种。一种是你想做的东西在十一行里对不上任何一行的 What It Produces——那说明它大概率不在「挑一条配一下就能跑」的路径上,得先确认仓库里到底有没有对应的 manifest,而不是硬套一条名字最接近的。另一种是名字看着对上了,但 manifest 里的字段不支持你的入口方式或扩展需求,比如上面那两个 false。这两种情况下,README 的表都不是判据,pipeline_defs/ 下的 YAML 才是。


本文依据 OpenMontage 官方仓库(github.com/calesthio/OpenMontage)的 README、 AGENT_GUIDE.mdconfig.yamlpipeline_defs/lib/ 下的治理模块整理,核对日 2026-08-09。 本文内容为仓库源码与文档口径,我们没有安装或运行过该系统,也没有调用过其中任何一个 provider API, 文中出现的成本数字均为项目方在 README 中自行标注的金额,非我们的实测结果。 该项目以 AGPL-3.0 发布,部分流水线在 manifest 中自标 stability: beta,请以仓库最新内容为准。

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。