ComfyUI 接入 MiniMax H3:从装节点到出第一条片

ComfyUI 接入 MiniMax H3:从装节点到出第一条片

前面那篇讲了 MiniMax H3 本身能做什么。这篇讲怎么把它接进 ComfyUI——让你的文生视频 / 图生视频 / V2V 动作迁移,跑在一套你熟悉的可视化工作流里,和 Stable Diffusion 的其它节点串起来。

全文按「能跑通」的顺序走:装节点 → 配 Key → 搭工作流 → 出片 → 排错。

一、前置条件

  • 一台已经能正常启动的 ComfyUI(本机或云端都行)。
  • 一个 MiniMax 账号,并在平台拿到 API Key(位置:MiniMax 开放平台 → 控制台 → API 密钥)。
    • 注意 H3 走的是 MiniMax 的视频生成 API,不是聊天的 Chat 接口,密钥通用但接口地址不同,下面会给出。
    • 部分账号还需要 Group ID(组织 ID),在控制台 URL 或「设置-组织」里能看到,先备着。
  • 能访问外网(H3 是云端推理,节点只是帮你把请求发到 MiniMax 服务器)。

二、安装 ComfyUI 的 MiniMax 节点

最省事的方式是用 ComfyUI-Manager

  1. 打开 ComfyUI,进入 ManagerInstall Custom Nodes
  2. 搜索 MiniMax(或 ComfyUI-MiniMaxMiniMax Video),找到社区维护的节点包,点 Install。
  3. 装完重启 ComfyUI(有些节点还要 pip install 额外依赖,Manager 通常会自动处理;若启动报错缺包,进 ComfyUI 目录手动 pip install -r custom_nodes/<节点目录>/requirements.txt)。
  4. 重启后进画布,右键 Add Node 能搜到 MiniMax 相关节点,说明装好了。

不想用 Manager,也可以手动装:

cd ComfyUI/custom_nodes
git clone https://github.com/<作者>/ComfyUI-MiniMax.git
cd ComfyUI-MiniMax
pip install -r requirements.txt

节点包名字、作者会随版本变,以 ComfyUI-Manager 里搜到的为准。装不上时优先看该仓库的 README,不同包的参数命名略有差异。

三、配置 API Key

三种常见做法,按你的节点包支持情况选:

做法 A:节点上直接填 Key(最常见)
工作流里放一个 MiniMax API Key 节点(或 Image/Video 节点自带 key 输入框),把密钥粘进去。缺点是 Key 明文留在工作流 JSON 里,别把含 Key 的工作流随便发给别人。

做法 B:读环境变量(推荐)
在启动 ComfyUI 前导出:

export MINIMAX_API_KEY="你的key"
# 需要 Group ID 的话
export MINIMAX_GROUP_ID="你的groupid"

节点检测到环境变量就自动用,工作流里不用填 Key,安全也干净。本机常驻可以把这两行写进启动脚本。

做法 C:配置文件
少数节点包读 ComfyUI/custom_nodes/ComfyUI-MiniMax/config.json

{
  "api_key": "你的key",
  "group_id": "你的groupid"
}

配好之后,画布上拖一个 MiniMax Video 节点,如果不再弹「key 未设置」之类的红字,就说明通了。

四、搭第一条工作流(文生视频)

目标:输入一段提示词,产出一段 H3 视频。

节点连线大致是:

[CLIP Text Encode / 文本输入]  ──prompt──▶  [MiniMax Video 节点]
[MiniMax API Key 节点]         ──key────▶  [MiniMax Video 节点]
[MiniMax Video 节点]           ──video──▶  [Preview / Save Video]

关键参数(不同包命名可能不同,认功能不认名字):

参数 建议 说明
prompt 画面/音频/规格分三段写 沿用上篇的写法,H3 才认真处理音频
duration 15 上限 15 秒
resolution 1080p / 2K 2K 最稳,4K 目前给不了
aspect_ratio 16:9 / 9:16 / 1:1 一开始定死,别后期裁
seed 留空随机 / 固定复现 想复现同一条就固定
audio on 原生双声道,开着

Queue Prompt,等几十秒到一两分钟(云端推理,越长越慢),预览窗就会出现带原声的视频。

五、图生视频 & V2V 动作迁移

图生视频:加一个 Load Image 节点,把产品图 / 角色图喂给 MiniMax Video 节点的 image 输入,提示词里写「保持参考图外观一致」,H3 会基于这张图运动。

V2V 动作迁移:再拖一个 Load Video 节点当动作参考,连到 motion_reference,提示词写「把参考视频的舞蹈动作迁移到形象参考人物身上」。这是 H3 被点名的强项,做数字人 / 换装素材很省事。

[Load Image]  ──image──▶  [MiniMax Video]
[Load Video]  ──motion──▶ [MiniMax Video]
[Text]        ──prompt──▶ [MiniMax Video]
[MiniMax Video] ──video──▶ [Save Video]

六、和 Stable Diffusion 节点串起来

ComfyUI 的好处是能拼。一个实用组合:

  • SD / Flux 出一张高质量首帧图 → Load Image → 喂给 MiniMax 做图生视频 → 得到动态版。
  • 或先用 Upscale 节点把参考图超到 2K,再送 H3,画质更稳。

这样「静态精美图」和「动态有声视频」各取所长,比单靠一个模型死磕更可控。

七、常见坑

坑 1:401 / 403
Key 错了、复制时多了空格、或用了 Chat 接口的 Key 当视频 Key。重新核对,Group ID 漏填也会报权限错。

坑 2:节点装完搜不到
没重启 ComfyUI,或依赖没装全。看启动日志里有没有 import 报错,按提示补包。

坑 3:出片特别慢 / 排队
H3 是云端推理,高峰期排队正常。别在循环节点里疯狂连发,容易触发限流。

坑 4:Key 泄露
用做法 A 时 Key 写进了工作流 JSON。分享工作流前记得清掉 Key 节点,或改用环境变量做法。

坑 5:音画不同步
多发生在提示词把音频和画面混写。严格按「画面 / 音频 / 规格」分三段,音频事件用时间戳绑定(如「第 8 秒叮一下」)。

八、小结

ComfyUI 接 MiniMax H3 不复杂:装节点 → 配 Key(优先环境变量)→ 拖 Video 节点连 prompt/image/motion → Queue。价值在于把 H3 塞进你已有的可视化工作流,和 SD 出图、超分、剪辑节点自由串联,批量出「有声有画」的短视频。

节点包名称、参数、API 地址随版本变动,以 MiniMax 官方文档和你所用节点包的 README 为准。

相关阅读

← 返回博客列表