📦 ComfyUI MiniMax H3 Director 工作流部署教程

本教程将指导您部署 ComfyUI 的 MiniMax H3 Director 工作流,这是一个用于视频生成、编辑和换人的 AI 工具集。它包含了 5 份可直接导入的工作流,支持文生视频、图生视频、首尾帧、参考素材生视频、视频编辑和参考素材改视频。


⚙️ 部署前准备

硬件与环境要求

  • 显卡与显存:推荐 NVIDIA RTX 4090 48GB。此显存可完整运行所有工作流。低显存显卡可能无法加载全部模型。
  • ComfyUI 版本:需要 ComfyUI 0.30.0 或更高版本
  • PyTorch 与 CUDA:确保 ComfyUI 使用的 Python 环境安装了 PyTorch 2.11.0+CUDA 12.8+
  • 网络:需要从 Hugging Face 等源下载数十 GB 的模型权重。

🚀 部署步骤

步骤 1: 安装核心插件 (Director Node)

这个工作流依赖于上游的 ComfyUI_MiniMaxH3_Director 自定义节点。

  1. 进入 ComfyUI 的 custom_nodes 目录:

    1
    cd ComfyUI/custom_nodes
  2. 克隆插件仓库:

    1
    git clone https://github.com/AIMixer/ComfyUI_MiniMaxH3_Director.git
  3. 安装插件的 Python 依赖:

    1
    python -m pip install -r ComfyUI_MiniMaxH3_Director/requirements.txt

步骤 2: 下载工作流文件

这个仓库 (huangserva/ComfyUI_MiniMaxH3_Director) 提供了 5 份预置的工作流 JSON 文件。你可以选择以下任一方式获取:

  • 方式一:直接从本仓库的 example_workflows/ 目录下载所有 .json 文件。

  • 方式二:克隆本仓库:

    1
    git clone https://github.com/huangserva/ComfyUI_MiniMaxH3_Director.git

    然后进入 example_workflows/ 文件夹。

步骤 3: 下载并放置模型权重

这是最关键的一步,你需要将对应的模型文件放入 ComfyUI 正确的目录下。

工作流类型 使用的模型文件 (放置于 ComfyUI/models/) 用途
T2V, I2V, FL2V diffusion_models/minimax_h3_fl2va_pruned_int8_convrot.safetensors 文生视频/图生视频基础模型
R2V, V2V, RV2V diffusion_models/minimax_h3_ref2va_pruned_int8_convrot.safetensors 参考素材/视频编辑模型
所有工作流共用 text_encoders/qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors 文本编码器
所有工作流共用 vae/minimax_h3_video_vae_fp16.safetensors 视频 VAE
所有工作流共用 vae/minimax_h3_audio_vae_fp32.safetensors 音频 VAE

模型来源:你可以从 Comfy-Org/MiniMax-H3 的 Hugging Face 仓库下载上述模型文件。注意目录结构需与上表一致。

步骤 4: 导入并使用工作流

  1. 启动 ComfyUI (如果已在运行,需重启以加载新插件)。
  2. 导入工作流:将下载的 .json 文件(如 minimax_h3_director_t2v.json直接拖拽到 ComfyUI 的网页界面中。
  3. 配置节点
    • CLIP Loader 节点中,类型 (Type) 必须选择 minimax
    • 根据你使用的模型,在 UNET Loader 节点中选择对应的 fl2varef2va 模型文件。
  4. 输入提示词与素材:根据工作流类型,在对应的节点中输入文本提示词、上传图片或视频。
  5. 执行生成:点击 Queue Prompt 按钮开始生成。

🎬 工作流使用说明

这 5 个工作流各有侧重,请根据你的需求选择:

文件名 核心功能 使用场景
minimax_h3_director_t2v.json 文生视频 (T2V) 仅通过文本描述生成视频。
minimax_h3_director_fl2v.json 首尾帧 / 图生视频 (FL2V / I2V) 提供首帧和尾帧图片生成过渡视频;仅提供首帧时等效于图生视频。
minimax_h3_director_r2v.json 参考素材生视频 (R2V) 提供图片、视频或音频作为参考,生成与之匹配的新视频。
minimax_h3_director_v2v.json 视频编辑 (V2V) 按源视频的时间轴,逐段进行编辑和修改。
minimax_h3_director_rv2v.json 参考素材改视频 (RV2V) 视频换人/换装:使用源视频+人物参考图,生成保持动作但改变人物的新视频。

RV2V (视频换人) 工作流特别提示

  1. 分段处理:源视频需按镜头或使用智能分割切成多个片段。
  2. 引用素材:在提示词中,源视频片段用 <Video 1> 指代,参考图用 <Picture N>,参考音频用 <Audio J>
  3. 分步生成:建议先生成 5 秒短片段,检查人脸一致性、服装和动作衔接,满意后再扩展全片。

🔧 性能优化与故障排查

  • 显存不足
    • 如果显存低于 48GB,尝试降低生成视频的 分辨率帧数 (steps)视频长度
    • 在 UNET Loader 后连接 SageAttention 等优化补丁节点(需先安装 SageAttention)以加速并降低显存占用。
  • 节点未注册错误
    • 确保插件已正确安装在 custom_nodes 目录下,并已安装其 requirements.txt
    • 重启 ComfyUI 以确保新节点被加载。
  • 模型加载失败
    • 检查模型文件是否放置在正确的目录,且文件名与工作流中 UNET Loader 节点的设置完全一致。
    • 确认 CLIP Loader 节点的类型已改为 minimax
  • 生成视频质量不佳
    • 固定源素材、提示词、随机种子 (seed)、分辨率和步数,进行 A/B 测试以调整参数。
    • RV2V 中人物身份一致性由模型和参考素材共同决定,需提供足够清晰、多角度的参考图。

📚 来源与许可

  • 工作流来源:本仓库 (huangserva/ComfyUI_MiniMaxH3_Director) 是上游 AIMixer/ComfyUI_MiniMaxH3_Director 的副本。
  • 模型权重:来自 Comfy-Org/MiniMax-H3,遵循其各自的许可条款。
  • 代码许可:工作流与上游插件按 Apache-2.0 许可发布。

更详细的节点说明和高级用法,请务必查阅上游插件的官方文档和 ComfyUI 的 MiniMax H3 工作流指南