### [开源免费的MiniMax H3 本地部署与使用教程](https://www.zuoshipin.com/article/23105) **Published:** 2026-08-19T04:14:03 **Author:** 天才交易员 **Excerpt:** MiniMax H3 本地部署完整教程:从硬件配置、ComfyUI 0.30.0、四个模型文件与目录,到 T2V/I2V/R2V 使用、5 秒测试、提示词、OOM 排错和许可注意事项。 **从硬件判断、ComfyUI 0.30.0 安装、四个基础模型下载,到 T2V/I2V/R2V 工作流、5 秒验收、提示词和 OOM 排错,这是一篇可以照着完成的 MiniMax H3 本地部署指南。** MiniMax H3 开放权重后,AI 视频终于多了一条“把模型放进自己电脑”的路线。本地运行不再按生成条数支付 API 费用,但显卡、内存、磁盘、电费、下载时间和维护成本仍然需要自己承担。 本文结合多份安装教程重新梳理,并以当前官方仓库和 ComfyUI 文档为准。你会看到最稳妥的安装顺序,也会知道哪些是官方能力、哪些只是社区硬件实测。 ![MiniMax H3本地部署与ComfyUI安装教程](https://admin.zuoshipin.com/wp-content/uploads/2026/08/minimax-h3-local-deployment-cover.png) ## 一、MiniMax H3 是什么?本地版能做什么? MiniMax H3 是一个开放权重的全模态视频生成系统,可以在同一个上下文中理解文字、图片、视频和音频,并联合生成视频画面、对白、环境声、音效和音乐。官方完整系统支持最长约 15 秒、最高 2K 和原生立体声音频。 ![](http://admin.zuoshipin.com/wp-content/uploads/2026/08/iShot_2026-08-19_12.20.41-1024x385.jpg) **这里必须区分完整系统和本地开放权重:**当前本地部署的核心是 H3-Base,原生画布短边约 768 像素;Context-IR 与 Regenerate-2K 并没有以同样方式完整开放。因此,“H3 系统最高支持 2K”不等于“下载本地权重后可以直接跑完整 2K 链路”。本地生成后需要更高分辨率时,可以再使用放大、补帧或云端能力。 ### 三种常用工作流 - **T2V(文生视频):**根据文字提示生成带声音的视频,最适合第一次做环境验收。 - **I2V / FL2V(图生视频 / 首尾帧):**用首帧或首尾关键帧控制人物、服装、构图和画面风格,更适合正式创作。 - **R2V(参考生视频):**同时引用图片、视频和音频,用来锁定人物身份、风格、动作、运镜或声音。 ![](http://admin.zuoshipin.com/wp-content/uploads/2026/08/iShot_2026-08-19_12.21.11-1024x603.jpg) ![](http://admin.zuoshipin.com/wp-content/uploads/2026/08/iShot_2026-08-19_12.22.11-1024x507.jpg) ## 二、先看硬件:你的电脑适合本地部署吗? 官方没有承诺“某张显卡一定流畅”。ComfyUI 的 Pruned INT8 扩散模型配合 NVFP4 文本编码器降低了本地门槛,社区已有 RTX 4080 16GB 等消费显卡运行记录,但速度、分辨率和稳定性会受 CUDA、PyTorch、内存卸载、驱动及工作流影响。 ![MiniMax H3本地部署显卡内存硬盘参考配置](https://admin.zuoshipin.com/wp-content/uploads/2026/08/minimax-h3-hardware-reference.png) | 硬件 | 建议 | 说明 | | --- | --- | --- | | GPU | NVIDIA 16GB 显存作为社区可行起点 | 更高显存更省卸载时间;不是官方最低保证 | | 系统内存 | 32GB 可尝试,推荐 64GB | 显存不足时需要向内存卸载,Windows 还应保留页面文件 | | 磁盘 | 至少预留 60GB | T2V/I2V 四文件约 39.5GiB(约 42.5GB),还要留缓存与输出空间 | | 系统 | Windows 或 Linux | 确保 NVIDIA 驱动、PyTorch 与 CUDA 环境匹配 | 如果你只是偶尔生成几条视频,云端 API 往往更省事;已经拥有高显存显卡、需要频繁生成,或素材必须留在本机时,本地部署更有价值。 ## 三、安装或升级 ComfyUI 0.30.0+ MiniMax H3 节点已进入 ComfyUI 核心,要求 **ComfyUI 0.30.0 或更高版本**。使用原生模板时,不需要先安装同名第三方 H3 节点。 1. 从 [ComfyUI 官网](https://www.comfy.org/download)下载桌面版或可移植版(秋叶版),安装到空间充足的 SSD。 2. 打开 ComfyUI,在版本或更新页面确认核心版本。 3. 版本低于 0.30.0 时,选择 GitHub 最新版通道更新,然后完全重启软件。 4. 如果更新后仍找不到 H3 节点,同时更新 ComfyUI 依赖,不要急着混装旧版自定义节点。 ![在ComfyUI桌面版检查核心版本号](https://admin.zuoshipin.com/wp-content/uploads/2026/08/comfyui-version-check.png) ![通过GitHub最新版通道更新ComfyUI](https://admin.zuoshipin.com/wp-content/uploads/2026/08/comfyui-update-channel.png) ## 四、加载官方模板并下载 H3 模型 最省事的入口是 ComfyUI 官方模板库: 1. 打开左侧 **Template Library(模板)**; 2. 进入 **Video** 分类; 3. 搜索 MiniMax H3; 4. 第一次建议选择 **MiniMax H3 T2V** 做环境测试; 5. 模板提示缺少模型时,按弹窗下载对应文件。 ![ComfyUI模板库中的MiniMax H3 T2V I2V和R2V工作流](https://admin.zuoshipin.com/wp-content/uploads/2026/08/comfyui-minimax-h3-template-library.png) ### T2V 和 I2V 需要的四个基础文件 1. `minimax_h3_fl2va_pruned_int8_convrot.safetensors`,约 21GB; 2. `qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors`,约 15.7GB; 3. `minimax_h3_video_vae_fp16.safetensors`,约 5.21GB; 4. `minimax_h3_audio_vae_fp32.safetensors`,约 605MB。 模型可从 [Comfy-Org/MiniMax-H3](https://huggingface.co/Comfy-Org/MiniMax-H3) 获取。仓库还包含 BF16、FP8、INT8 和 R2V 等不同权重,不要“一次下载全部”,也不要随意混用名字相近的版本。 ![ComfyUI工作流提示下载MiniMax H3缺失模型](https://admin.zuoshipin.com/wp-content/uploads/2026/08/comfyui-minimax-h3-model-downloads.png) ### 手动下载时的模型目录 ``` ComfyUI/ └── models/ ├── diffusion_models/ │ └── minimax_h3_fl2va_pruned_int8_convrot.safetensors ├── text_encoders/ │ └── qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors └── vae/ ├── minimax_h3_video_vae_fp16.safetensors └── minimax_h3_audio_vae_fp32.safetensors ``` 使用 R2V 时,再额外下载并放入 `models/diffusion_models/`: ``` minimax_h3_ref2va_pruned_int8_convrot.safetensors ``` ![MiniMax H3四个模型文件放入三个ComfyUI目录](https://admin.zuoshipin.com/wp-content/uploads/2026/08/minimax-h3-model-folders.png) 四个文件齐全后重启或刷新 ComfyUI。如果节点仍显示模型缺失,逐项核对文件名、扩展名和目录,不要凭“看起来差不多”选 BF16、FP8 或其他 Ref2VA 权重。 ## 五、第一次运行:只做 5 秒 smoke test 第一次运行的目标不是追求画质,而是确认完整链路能跑通。建议保留官方 T2V 模板默认节点,只调整以下项目: - **比例:**16:9; - **像素量:**先使用快速预览,约 0.4-0.5MP; - **分辨率参考:**约 832×480; - **时长:**约 5 秒,实际帧数会按模型网格取整; - **Multiple:**保持 32; - **提示词:**一个主体、一个动作、一个简单声音。 > 雨后的城市街道,一辆红色自行车从左向右驶过,镜头缓慢跟随。地面有积水倒影,环境中能听到轮胎压过水面的声音和轻微风声。 ![MiniMax H3第一次本地五秒smoke test验收标准](https://admin.zuoshipin.com/wp-content/uploads/2026/08/minimax-h3-five-second-smoke-test.png) ### 通过标准 - 扩散模型、文本编码器和两个 VAE 都能成功加载; - 运行过程中没有因显存不足直接退出; - SaveVideo 节点成功生成 MP4; - 视频可以播放,并包含同步音轨; - 输出比例、尺寸和时长与工作流设置一致。 第一条成功后,再按“0.5MP → 1024×576 → 更长时长 → 约 1.0MP → 增加参考素材”的顺序逐步提高难度。官方建议 16:9 高质量输出约 1.0MP,对应大约 1344×768。 ## 六、正式创作:T2V、I2V 和 R2V 怎么选? ### T2V:验证环境和快速探索 T2V 不需要输入图,最适合测试模型与声画链路,也适合探索场景与镜头创意。但人物外观、服装和构图的一致性不如关键帧控制稳定。 ### I2V:正式短镜头的推荐入口 先制作目标比例的角色或场景首帧,再连接 `MiniMaxH3ImageToVideo` 节点。需要控制结束构图时可以同时连接尾帧。最终视频是 16:9,首帧也应是真正的 16:9 横图,不要依赖模型自动纠正竖图。 更稳定的制作流程是:人物设定图 → 目标比例关键帧 → I2V 生成 3-5 秒镜头 → 挑选有效片段 → 剪辑、放大、补帧与混音。 ### R2V:用参考素材锁定人物、风格和声音 R2V 使用独立的 `ref2va` 扩散权重。把参考素材按连接顺序写成 ``、`