MiniMax H3 的五个模型文件分别放哪:ComfyUI 侧的下载来源、目录对应与验收方法

2026-08-09

在 ComfyUI 里跑 MiniMax H3,第一道门槛不是显卡也不是工作流,是把五个模型文件放对位置。这件事看着像体力活,实际有两个坑埋得挺深:一是权重仓库找错了地方,二是以为下一个扩散模型就够了。这两个坑都不会在下载阶段报错,而是等你把工作流拖进来、点开节点下拉框、发现里面空空如也的时候才发作。

下面按 docs.comfy.org 的官方 H3 教程页和 Comfy-Org/workflow_templates 仓库里的模板文件,把这五个文件讲清楚。核对日期是 2026-08-09。

先看版本门槛

官方教程页写明需要 ComfyUI version 0.30.0 or later,v0.30.0 发布于 2026-08-03。紧接着的 v0.31.0(2026-08-08)release notes 里有一条「fix(minimax): cast raw parameters to input device in H3 VAEs by @rivadart in PR #15268」——也就是说 H3 支持刚落地一个版本,就修了 H3 VAE 的一个设备转换问题。所以要跑 H3,建议至少更新到 v0.31.0,别停在 0.30.0。

另外模板说明里有一句官方提示值得记住:Desktop 与 Cloud 版本跟随 stable 发布,因此某些「nightly 才支持」的模型可能在这两个渠道上还不可用。如果你用的是 Desktop 版,先确认版本号再折腾模型文件,否则文件全放对了节点也出不来。

五个文件与目录的对应表

类别文件名放置目录
diffusion_models(t2v/i2v 用)minimax_h3_fl2va_pruned_int8_convrot.safetensorsComfyUI/models/diffusion_models/
diffusion_models(r2v 用)minimax_h3_ref2va_pruned_int8_convrot.safetensorsComfyUI/models/diffusion_models/
text_encodersqwen3vl_32b_minimax_h3_nvfp4_awq.safetensorsComfyUI/models/text_encoders/
vae(视频)minimax_h3_video_vae_fp16.safetensorsComfyUI/models/vae/
vae(音频)minimax_h3_audio_vae_fp32.safetensorsComfyUI/models/vae/

注意最后两行:H3 要两个 VAE,一个视频一个音频,都落在同一个 vae/ 目录里。这不是笔误,也不是二选一。H3 的采样输出是音视频联合的 LATENT,模板里 VAEDecode 走视频 VAE、VAEDecodeAudio 走音频 VAE,每个解码节点自己从打包的 latent 里取属于它的那一半,最后由 CreateVideo mux 成一个带同步声音的 MP4。少一个 VAE,链路就断在解码这一段。

官方模板里给的目录树是这样的(原样):

📂 ComfyUI/
├── 📂 models/
│   ├── 📂 vae/
│   │   ├── minimax_h3_video_vae_fp16.safetensors
│   │   └── minimax_h3_audio_vae_fp32.safetensors
│   ├── 📂 diffusion_models/
│   │   └── minimax_h3_fl2va_pruned_int8_convrot.safetensors
│   └── 📂 text_encoders/
│       └── qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors

这棵树是 t2v/i2v 模板给的版本,diffusion_models/ 下挂的是 fl2va;r2v 模板那棵树里换成 ref2va 那一个。两个文件同在 diffusion_models/ 目录下并存没有任何问题。

★ 权重来自 Comfy-Org/MiniMax-H3,不是 MiniMaxAI/MiniMax-H3

这是本文最需要说清楚的一条。ComfyUI 用的权重托管在 huggingface.co/Comfy-Org/MiniMax-H3,而 MiniMax 官方发布的权重在 MiniMaxAI/MiniMax-H3。两个仓库名长得很像,搜索时也容易点错,但里面的东西不是一回事。

差别在权重形态上:MiniMax 官方 README 说发布的 checkpoint 精度是 BF16;而 ComfyUI 侧的扩散模型文件名里带 pruned_int8_convrot,文本编码器带 nvfp4_awq——从命名就能看出是量化/裁剪过的版本。ComfyUI 在 v0.27.0(2026-06-30)的主要变化就是「新增 int8 convrot 模型支持」,v0.30.0 又加了「int8 convrot embedding lookup」(PR #15035),这条支持线是专门为这类权重铺的。

所以有两个结论要分开记:

第一,从 MiniMaxAI/MiniMax-H3 下载的原始 checkpoint 不能直接丢进 ComfyUI/models/diffusion_models/ 期待它能用,那套权重是照 MiniMax README 用 SGLang/vLLM 那条路跑的,跟 ComfyUI 的加载路径不是一个前提。

第二,在 ComfyUI 里跑出来的 H3 和照 MiniMax 官方文档跑出来的 H3,权重精度不是一回事。官方教程和 MiniMax README 都没有给出两者的对比数据,我们也没有任何评测依据,所以这里只说一句实际可操作的建议:评估效果时不要把两边的结果混为一谈,尤其别拿 ComfyUI 里的结果去反推 MiniMax 官方模型的表现,反过来也一样。

顺便提一句范围问题:H3 完整系统里的 H3-Context-IR 与 H3-Regenerate-2K 两个模块并未开源、只提供 API,ComfyUI 侧的模板里也没有它们。所以别指望在本地这套文件里找到 2K 相关的东西。

下载地址是什么形态

官方给出的下载地址形如:

https://huggingface.co/Comfy-Org/MiniMax-H3/resolve/main/<子目录>/<文件名>

这里的 <子目录> 我们没有从官方教程里拿到确切名字,请以 Hugging Face 仓库页面上实际列出的路径为准——不要照着目录表里的 diffusion_models / text_encoders / vae 去猜仓库内的子目录名,仓库内的组织方式和你本地的 models/ 结构是两回事,猜错了就是 404。稳妥做法是打开 huggingface.co/Comfy-Org/MiniMax-H3 的 Files 页面,找到文件名后直接复制它的下载链接。

本地这边可以先按官方目录树把三个目录准备好:

mkdir -p ComfyUI/models/diffusion_models
mkdir -p ComfyUI/models/text_encoders
mkdir -p ComfyUI/models/vae

Windows 下如果用 PowerShell,换成对应的 New-Item -ItemType Directory -Force 即可;实际上标准 ComfyUI 安装里这三个目录本来就存在,这一步只是给自定义安装路径或者从压缩包解压的情况兜个底。以上为按官方目录树整理的路径操作,不是官方文档里给出的命令,官方教程只给了文件名与目标目录。

fl2va 与 ref2va:两套权重,都要用就都得下

这是第二个高频误会。教程页列了三个官方模板:Text-to-Video(T2V)、Image-to-Video(I2V)、Reference-to-Video(R2V)。很多人默认「三个模板共用一个模型」,然后只下了 fl2va 那一个,打开 R2V 模板发现 UNETLoader 里选不到东西。

官方模板说明里对这点写得很直白:R2V 用的权重「is a different set of weights from the fl2va model used by the t2v/i2v templates」。对应到 MiniMax 官方 README 也是同一套划分——H3-Base FL2VA 负责 t2vafl2va(文本,可选首帧/尾帧/两者都给),H3-Base Ref2VA 负责 ref2va(文本 + 参考图像、视频和/或音频)。任务族不同,权重就不同。

所以判断依据很简单:

  • 只做文生视频、首尾帧生视频 → 下 minimax_h3_fl2va_pruned_int8_convrot.safetensors
  • 要用参考图/参考视频/参考音频驱动 → 下 minimax_h3_ref2va_pruned_int8_convrot.safetensors
  • 两类都想试 → 两个都下,一起放在 diffusion_models/

文本编码器与两个 VAE 是共用的,不管你走哪条路都得有。也就是说最小可用集合是「一个扩散模型 + 一个文本编码器 + 两个 VAE」共四个文件,全都要就是五个。

怎么验收:去节点的下拉框里找

模型文件放没放对,最直接的验收方式是在 ComfyUI 里打开对应模板,逐个检查加载器节点的下拉选项。R2V 模板里这几个节点的取值可以直接对照(这些值来自模板 JSON):

节点应该能选到 / 模板里的取值
UNETLoaderminimax_h3_ref2va_pruned_int8_convrot.safetensors,weight_dtype 为 default
CLIPLoaderqwen3vl_32b_minimax_h3_nvfp4_awq.safetensors,type 为 minimax,device 为 default
VAELoader(第一个)minimax_h3_video_vae_fp16.safetensors
VAELoader(第二个)minimax_h3_audio_vae_fp32.safetensors

验收要点有三处:

第一,看下拉框里有没有这个文件名。 如果节点里选不到,先别怀疑模型损坏,最常见的原因是路径层级不对——比如多套了一层目录(比如把整个下载文件夹连同它的名字一起搬进了 models/),或者文件落在了 models/checkpoints/ 而不是 diffusion_models/。文件名本身不要改,模板里是按名字匹配的,改名之后就得手动重选。

第二,CLIPLoader 的 type 必须是 minimax 这个下拉项跟文件名是两个独立的字段,选错了文件依旧能加载出来,所以肉眼扫一遍很容易漏过去。官方 R2V 模板里这一项的取值就是 minimax,直接加载模板不用管;手动搭图或者从别的工作流改过来的时候,这一项最容易保持在上一个模型的取值上。至于选错之后 ComfyUI 具体报什么错,官方教程没有写,我们不猜——按模板取值对齐就是了。

第三,两个 VAELoader 别选重。 两个 VAE 都在同一个 vae/ 目录下、下拉框里挨着,选成两个视频 VAE 或者两个音频 VAE 都是一眼看不出来的错。确认一个是 ..._video_vae_fp16、另一个是 ..._audio_vae_fp32,再看它们分别连到 VAEDecodeVAEDecodeAudio

如果下拉框里刷不出新文件,先刷新一次再看:ComfyUI 官方 README 的快捷键表里,R 对应的就是「刷新图」。至于它内部什么时候扫描模型目录、缓存到什么时候失效,官方文档没有交代,这里就不替它编一套解释了——先按快捷键刷新,再复查目录层级,两步就够定位到底是没刷新还是放错了地方。

什么情况下别按这篇做

你想复现 MiniMax 官方那条链路。 如果目标是照 MiniMax README 用官方推理栈跑 BF16 权重,那就该去 MiniMaxAI/MiniMax-H3 拿官方 checkpoint,本文这五个文件跟那条路无关。两条路的权重形态、加载方式、可用模块都不同,混着用只会浪费带宽。

你在评估「H3 到底行不行」并准备写结论。 ComfyUI 侧是量化权重,官方侧是 BF16,拿 ComfyUI 的产出去下 H3 模型能力的结论,前提就站不住。要下这类结论至少得把两边的口径讲清楚。

你的 ComfyUI 还在 0.30.0 之前。 版本不到位的话,文件放得再整齐节点也不会出现,先更新再说。Desktop / Cloud 用户尤其要先确认自己拿到的是哪个通道的版本。

你在做多机部署或共享模型目录。 本文讲的是单机默认路径,多实例共享模型目录涉及 ComfyUI 的额外模型路径配置,那是另一个话题,别把这里的目录树直接套过去。

最后说一句关于「跑不跑得动」。官方教程页没有给出这五个文件的体积,MiniMax README 也没有给显存数字——所以本文一个数都不写。这不是回避,是确实没有可引用的依据。别处看到的数字我们无法核实来源,不建议当成参数直接套;能确定的只有一点:ComfyUI 侧这套权重的文件名里带 pruned_int8_convrotnvfp4_awq,是量化/裁剪过的形态,跟 MiniMax 官方 BF16 checkpoint 不是同一套东西,拿官方那边的经验来估这边同样估不准。真要一个数,只能以自己那台机器上的实际情况为准。

遇到问题时官方模板说明里给了明确的分流规则,照着提就行:跑不起来或运行时报错去 github.com/comfyanonymous/ComfyUI/issues,UI / 前端问题去 github.com/Comfy-Org/ComfyUI_frontend/issues,工作流本身有问题去 github.com/Comfy-Org/workflow_templates/issues。模型文件放置相关的坑通常属于第一类或第三类,报的时候把版本号和目录结构贴上会省很多来回。

延伸阅读


本文依据 MiniMax H3 官方仓库(github.com/MiniMax-AI/MiniMax-H3)的 README、模型配置文件与官方 h3-prompt-writing skill 文档,以及 ComfyUI 官方仓库(github.com/Comfy-Org/ComfyUI)的 README、comfy/cli_args.py、release notes 整理,核对日 2026-08-09,对应 ComfyUI 版本 v0.31.0。ComfyUI 侧的模型文件与工作流信息来自 docs.comfy.org 的官方教程与 Comfy-Org/workflow_templates 仓库的模板文件。本文内容为官方文档与源码口径,非本机实测,未在本机部署或调用过 H3。参数、默认值、模型文件与许可条款随版本变动,请以官方文档、python main.py --help 的实际输出与官方最新说明为准。许可条款请以官方 LICENSE 原文(MiniMax H3 Community License Agreement)为准,本文不构成法律意见。

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。