ComfyUI 的 MiniMax H3 Director 用于视频生成、编辑和换人的 AI 工具集
📦 ComfyUI MiniMax H3 Director 工作流部署教程
本教程将指导您部署 ComfyUI 的 MiniMax H3 Director 工作流,这是一个用于视频生成、编辑和换人的 AI 工具集。它包含了 5 份可直接导入的工作流,支持文生视频、图生视频、首尾帧、参考素材生视频、视频编辑和参考素材改视频。
⚙️ 部署前准备
硬件与环境要求
- 显卡与显存:推荐 NVIDIA RTX 4090 48GB。此显存可完整运行所有工作流。低显存显卡可能无法加载全部模型。
- ComfyUI 版本:需要 ComfyUI 0.30.0 或更高版本。
- PyTorch 与 CUDA:确保 ComfyUI 使用的 Python 环境安装了 PyTorch 2.11.0+ 和 CUDA 12.8+。
- 网络:需要从 Hugging Face 等源下载数十 GB 的模型权重。
🚀 部署步骤
步骤 1: 安装核心插件 (Director Node)
这个工作流依赖于上游的 ComfyUI_MiniMaxH3_Director 自定义节点。
进入 ComfyUI 的
custom_nodes目录:1
cd ComfyUI/custom_nodes
克隆插件仓库:
1
git clone https://github.com/AIMixer/ComfyUI_MiniMaxH3_Director.git
安装插件的 Python 依赖:
1
python -m pip install -r ComfyUI_MiniMaxH3_Director/requirements.txt
步骤 2: 下载工作流文件
这个仓库 (huangserva/ComfyUI_MiniMaxH3_Director) 提供了 5 份预置的工作流 JSON 文件。你可以选择以下任一方式获取:
方式一:直接从本仓库的
example_workflows/目录下载所有.json文件。方式二:克隆本仓库:
1
git clone https://github.com/huangserva/ComfyUI_MiniMaxH3_Director.git
然后进入
example_workflows/文件夹。
步骤 3: 下载并放置模型权重
这是最关键的一步,你需要将对应的模型文件放入 ComfyUI 正确的目录下。
| 工作流类型 | 使用的模型文件 (放置于 ComfyUI/models/) |
用途 |
|---|---|---|
| T2V, I2V, FL2V | diffusion_models/minimax_h3_fl2va_pruned_int8_convrot.safetensors |
文生视频/图生视频基础模型 |
| R2V, V2V, RV2V | diffusion_models/minimax_h3_ref2va_pruned_int8_convrot.safetensors |
参考素材/视频编辑模型 |
| 所有工作流共用 | text_encoders/qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors |
文本编码器 |
| 所有工作流共用 | vae/minimax_h3_video_vae_fp16.safetensors |
视频 VAE |
| 所有工作流共用 | vae/minimax_h3_audio_vae_fp32.safetensors |
音频 VAE |
模型来源:你可以从 Comfy-Org/MiniMax-H3 的 Hugging Face 仓库下载上述模型文件。注意目录结构需与上表一致。
步骤 4: 导入并使用工作流
- 启动 ComfyUI (如果已在运行,需重启以加载新插件)。
- 导入工作流:将下载的
.json文件(如minimax_h3_director_t2v.json)直接拖拽到 ComfyUI 的网页界面中。 - 配置节点:
- 在 CLIP Loader 节点中,类型 (Type) 必须选择
minimax。 - 根据你使用的模型,在 UNET Loader 节点中选择对应的
fl2va或ref2va模型文件。
- 在 CLIP Loader 节点中,类型 (Type) 必须选择
- 输入提示词与素材:根据工作流类型,在对应的节点中输入文本提示词、上传图片或视频。
- 执行生成:点击 Queue Prompt 按钮开始生成。
🎬 工作流使用说明
这 5 个工作流各有侧重,请根据你的需求选择:
| 文件名 | 核心功能 | 使用场景 |
|---|---|---|
minimax_h3_director_t2v.json |
文生视频 (T2V) | 仅通过文本描述生成视频。 |
minimax_h3_director_fl2v.json |
首尾帧 / 图生视频 (FL2V / I2V) | 提供首帧和尾帧图片生成过渡视频;仅提供首帧时等效于图生视频。 |
minimax_h3_director_r2v.json |
参考素材生视频 (R2V) | 提供图片、视频或音频作为参考,生成与之匹配的新视频。 |
minimax_h3_director_v2v.json |
视频编辑 (V2V) | 按源视频的时间轴,逐段进行编辑和修改。 |
minimax_h3_director_rv2v.json |
参考素材改视频 (RV2V) | 视频换人/换装:使用源视频+人物参考图,生成保持动作但改变人物的新视频。 |
RV2V (视频换人) 工作流特别提示
- 分段处理:源视频需按镜头或使用智能分割切成多个片段。
- 引用素材:在提示词中,源视频片段用
<Video 1>指代,参考图用<Picture N>,参考音频用<Audio J>。 - 分步生成:建议先生成 5 秒短片段,检查人脸一致性、服装和动作衔接,满意后再扩展全片。
🔧 性能优化与故障排查
- 显存不足:
- 如果显存低于 48GB,尝试降低生成视频的 分辨率、帧数 (steps) 或视频长度。
- 在 UNET Loader 后连接 SageAttention 等优化补丁节点(需先安装 SageAttention)以加速并降低显存占用。
- 节点未注册错误:
- 确保插件已正确安装在
custom_nodes目录下,并已安装其requirements.txt。 - 重启 ComfyUI 以确保新节点被加载。
- 确保插件已正确安装在
- 模型加载失败:
- 检查模型文件是否放置在正确的目录,且文件名与工作流中 UNET Loader 节点的设置完全一致。
- 确认
CLIP Loader节点的类型已改为minimax。
- 生成视频质量不佳:
- 固定源素材、提示词、随机种子 (seed)、分辨率和步数,进行 A/B 测试以调整参数。
- RV2V 中人物身份一致性由模型和参考素材共同决定,需提供足够清晰、多角度的参考图。
📚 来源与许可
- 工作流来源:本仓库 (huangserva/ComfyUI_MiniMaxH3_Director) 是上游 AIMixer/ComfyUI_MiniMaxH3_Director 的副本。
- 模型权重:来自 Comfy-Org/MiniMax-H3,遵循其各自的许可条款。
- 代码许可:工作流与上游插件按 Apache-2.0 许可发布。
更详细的节点说明和高级用法,请务必查阅上游插件的官方文档和 ComfyUI 的 MiniMax H3 工作流指南。
本博客所有文章除特别声明外,均采用 CC BY-NC-SA 4.0 许可协议。转载请注明来源 极客的赛博空间 | 专注 AI 与技术分享!
评论







