十一条流水线各产出什么:一张表配决策路径
选流水线这件事,最常见的错误做法是打开 README 那张表,从上往下扫 Best For 那一列,看见「教程」两个字就停下。问题是「教程」在这张表里出现了两次,「产品演示」也出现了两次,这四个格子分属三条完全不同的流水线。按这一列选,撞车躲不掉。
这张表真正能用的是另一列。
先把表原样摆出来
README 的 Pipelines 一节给的是这么十一行:
| Pipeline | What It Produces | Best For |
|---|---|---|
| Animated Explainer | 带调研、旁白、视觉、音乐的 AI 生成讲解片 | 教育内容、教程、主题拆解 |
| Animation | 动态图形、动态排版、动画序列 | 社交媒体、产品演示、抽象概念 |
| Avatar Spokesperson | 数字人主持的演示视频 | 企业沟通、培训、公告 |
| Cinematic | 预告片、teaser、氛围驱动的剪辑 | 品牌片、teaser、推广内容 |
| Clip Factory | 从一个长素材批量产出经过排序的短视频 | 把长内容改造成社媒短片 |
| Documentary Montage | 从 CLIP 索引的免费素材与开放档案语料库剪出的主题蒙太奇(Pexels、Archive.org、NASA、Wikimedia、Unsplash) | 视频随笔、氛围片、检索优先的 B-roll 剪辑、不用付费生成 API 的真实素材视频 |
| Hybrid | 源素材 + AI 生成的辅助视觉 | 用图形增强既有素材 |
| Localization & Dub | 给既有视频加字幕、配音、翻译 | 多语言分发 |
| Podcast Repurpose | 播客高光转视频 | 播客营销、音频波形视频 |
| Screen Demo | 打磨过的软件录屏与走查 | 产品演示、教程、文档 |
| Talking Head | 以说话人为主的视频 | 演讲、vlog、访谈 |
先说一句必要的提醒:这张表不是全集。 README 正文另一处写的是 “12 production pipelines”,而我们实读 pipeline_defs/ 数出 13 个 .yaml,实读 skills/pipelines/ 数出 12 个子目录。三组数字对不上,具体差在哪几条、哪一条流水线没进这张表,本批另有一篇专门讲,这里不展开。你只需要先接受一个前提:在这张表里没找到名字,不等于仓库里没有那条流水线。
另外,Best For 这一列是项目方在 README 里给出的定位说法,不是我们的选型推荐;下面的重排是我们按表格文字本身做的归类,也不构成对产出效果的任何判断。
三个可分辨的轴
把十一行按 What It Produces 那一列拆,会发现有三个轴是真正互斥、能用来做判断的。
第一个轴:素材从哪来。 这是差别最大的一条。Documentary Montage 明写素材来自 CLIP 索引的免费素材与开放档案语料库,点名了 Pexels、Archive.org、NASA、Wikimedia、Unsplash 五个来源,它的 Best For 里还有一句「不用付费生成 API 的真实素材视频」——这是整张表里唯一一处直接提到付费 API 的行。Animated Explainer 那行则明写是 AI 生成。Hybrid 走的是第三条路:源素材加 AI 生成的辅助视觉。而 Screen Demo(软件录屏与走查)、Podcast Repurpose(播客高光转视频)、Localization & Dub(给既有视频加字幕、配音、翻译)这三行,从描述本身就能看出输入是你自己手里的东西。表里没写来源的行(比如 Talking Head),这张表回答不了,别替它补上。
第二个轴:画面里有没有人,是谁。 只有两行涉及:Avatar Spokesperson 写的是数字人主持的演示视频,Talking Head 写的是以说话人为主的视频。这两行的产出物形态完全不同,别按 Best For 里的「企业沟通」「演讲」去区分。
第三个轴:你手里是不是已经有一条长内容。 Clip Factory 的描述是从一个长素材批量产出经过排序的短视频,Localization & Dub 是给既有视频加字幕、配音、翻译,Podcast Repurpose 是播客高光转视频,Hybrid 写的是源素材加 AI 生成的辅助视觉。这四行的共同前提是输入端已经有东西了,剩下七行的描述里没有这个前提。这一点在下面的决策路径里是第一个分岔,因为它能一刀切掉七行。
决策路径
按这三个轴倒推,选择顺序应该是这样的。
第一问:你手里已经有一条成片或长素材了吗? 有的话,先在改造类里选,不要去看生成类。只加字幕、配音、翻译,走 Localization & Dub;要从长片里切一批短的,走 Clip Factory;输入是播客,走 Podcast Repurpose;素材本身够用、只是想加点图形,走 Hybrid——它的定位原文就是「用图形增强既有素材」。这四条的区别在动作(翻译 / 切分 / 转形式 / 增强),不在题材。
第二问:没有现成素材,画面里要不要出现一个人? 要数字人主持,走 Avatar Spokesperson;要真人讲话为主,走 Talking Head。
第三问:没有素材、画面也不需要人,那你要的是解释还是氛围? 要把一件事讲明白,走 Animated Explainer——它是表里唯一一条把调研、旁白、视觉、音乐四件事同时写进产出物描述的流水线。要的是预告片、teaser、氛围驱动的剪辑,走 Cinematic。要的是动态图形、动态排版、动画序列这类没有具体拍摄对象的东西,走 Animation。
第四问:要不要真实世界的画面,又不想调付费生成 API? 那就是 Documentary Montage 这一行,它是表里把这个约束直接写进 Best For 的唯一一条。
至于录屏走查,Screen Demo 一行直取,没什么可犹豫的。真正需要花时间分辨的是 Animation 和 Screen Demo 都写了「产品演示」、Animated Explainer 和 Screen Demo 都写了「教程」这两处重叠——这两处只看 Best For 分不开,回到 What It Produces 那一列看产出物形态就清楚了:一个是动态图形、动态排版、动画序列,一个是打磨过的软件录屏与走查,还有一个是带调研、旁白、视觉、音乐的讲解片。三种产出物形态,Best For 里却挤在同两个词上。
表选完之后还得核什么
这张表只能帮你缩到一两个候选,它不是能力清单。真正说了算的是 pipeline_defs/ 下那条流水线自己的 manifest。
我们只完整读过其中一份——pipeline_defs/documentary-montage.yaml 的前 70 行,拿它当样本看看表里读不出来的东西有哪些:
- 顶层有
stability: beta,这是 manifest 里一个显式的稳定性标记,README 的表格里没有这一列。 reference_input段下supported: false。这条流水线不接参考视频入口。这是一个可核实的能力边界,也是 README 表格完全体现不出来的信息。这个字段本批另有一篇专门讲,这里只提示:选型时值得先去 manifest 里查一眼你要的入口方式支不支持。orchestration段里budget_default_usd: 1.00,低于config.yaml的全局默认total_usd: 10.00,说明单条流水线可以自带更紧的预算;同段还有max_revisions_per_stage: 3、max_send_backs: 2、max_wall_time_minutes: 60。extensions四个扩展开关里,custom_scripts、custom_playbooks、custom_skills都是true,只有custom_tools是false——这条流水线允许你加脚本、加 playbook、加 skill,但不允许自定义工具。required_skills列了 8 条:1 个执行制片(pipelines/documentary-montage/executive-producer)、5 个阶段导演(idea / scene / asset / edit / compose)、加meta/reviewer和meta/checkpoint-protocol两个 meta skill。
必须说清边界:以上全部只来自这一份 manifest 的前 70 行。 其余 12 份 manifest 我们没有读过,所以上面这些字段的取值不能往别的流水线上推——比如不要因为 documentary-montage 的 reference_input.supported 是 false,就认为别的流水线也不支持,或者反过来推断有几条支持。要知道另一条流水线怎么样,只能去打开它自己那份 YAML。
顺带说一句选型时容易多虑的地方:流程不是选型变量。 README 写的是每条流水线都遵循同一套结构化流程 research -> proposal -> script -> scene_plan -> assets -> edit -> compose,这套阶段流本批另有专篇。也就是说你在这张表上做的选择,选的是产出物形态和素材来源,不是工作方式——工作方式十一条是一样的。
还有成本。这张表里没有成本列,README 别处给演示视频和示例 prompt 标了金额,那些都是项目方在 README 中自行标注的数字,不是我们验证过的报价,也和「你选哪条流水线要花多少钱」之间不存在换算关系,别拿来做选型依据。
什么情况下这张表帮不上忙
两种。一种是你想做的东西在十一行里对不上任何一行的 What It Produces——那说明它大概率不在「挑一条配一下就能跑」的路径上,得先确认仓库里到底有没有对应的 manifest,而不是硬套一条名字最接近的。另一种是名字看着对上了,但 manifest 里的字段不支持你的入口方式或扩展需求,比如上面那两个 false。这两种情况下,README 的表都不是判据,pipeline_defs/ 下的 YAML 才是。
本文依据 OpenMontage 官方仓库(github.com/calesthio/OpenMontage)的 README、
AGENT_GUIDE.md、config.yaml、pipeline_defs/ 与 lib/ 下的治理模块整理,核对日 2026-08-09。
本文内容为仓库源码与文档口径,我们没有安装或运行过该系统,也没有调用过其中任何一个 provider API,
文中出现的成本数字均为项目方在 README 中自行标注的金额,非我们的实测结果。
该项目以 AGPL-3.0 发布,部分流水线在 manifest 中自标 stability: beta,请以仓库最新内容为准。