
MiniMax-H3 部署避坑清单文件放哪、显存爆了怎么救【免费下载链接】MiniMax-H3项目地址: https://ai.gitcode.com/hf_mirrors/Comfy-Org/MiniMax-H3下完一堆 .safetensors 不知道该丢进哪个文件夹跑到一半显存直接爆掉这篇只讲 MiniMax-H3 部署最容易卡住的两件事权重放对位置、按显存选对精度。三步走完基本一次跑通。✅ 先花 10 秒确认你的显卡能不能跑动手前先对一下硬件底细免得下载半天白忙一场显卡NVIDIA 系RTX 系列更稳显存建议 ≥ 8GB低配显卡能装但可能很慢甚至直接跑不起来底细不符就先停手硬件这块靠配置绕不过去。 第 1 步权重文件到底放哪个文件夹权重从哪下模型文件统一从官方仓库克隆一条命令拿全git clone https://gitcode.com/hf_mirrors/Comfy-Org/MiniMax-H3克隆完成后把仓库里的三个文件夹整个搬进 ComfyUI 的models目录。目录结构照抄下面这份一个字母都别改ComfyUI/models/ ├── diffusion_models/ │ ├── minimax_h3_fl2va_bf16.safetensors │ ├── minimax_h3_fl2va_pruned_bf16.safetensors │ ├── minimax_h3_fl2va_int8_convrot.safetensors │ ├── minimax_h3_fl2va_pruned_int8_convrot.safetensors │ ├── minimax_h3_fl2va_pruned_fp8_scaled.safetensors │ ├── minimax_h3_ref2va_bf16.safetensors │ ├── minimax_h3_ref2va_pruned_bf16.safetensors │ ├── minimax_h3_ref2va_int8_convrot.safetensors │ ├── minimax_h3_ref2va_pruned_int8_convrot.safetensors │ └── minimax_h3_ref2va_pruned_fp8_scaled.safetensors ├── text_encoders/ │ ├── qwen3vl_32b_minimax_h3_bf16.safetensors │ ├── qwen3vl_32b_minimax_h3_int8_convrot.safetensors │ └── qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors └── vae/ ├── minimax_h3_audio_vae_fp32.safetensors └── minimax_h3_video_vae_fp16.safetensors路径决定模型能不能被找到差一层文件夹就加载不出来。文件全部就位后I2V、T2V、R2V 这几类工作流模板就能直接挑着用。⚡ 第 2 步显存不够先切 int8 还是 fp8先说结论显存吃紧优先换 int8 或 fp8 版本别硬撑 bf16。文件名后缀就是精度标签对着挑bf16质量最高显存占用也最大int8_convrot、pruned_fp8_scaled通常明显更省显存举个具体的diffusion 模型可以从minimax_h3_fl2va_bf16.safetensors换成minimax_h3_fl2va_int8_convrot.safetensors换了低精度还爆就把输入分辨率调低一档占用会立刻下来。 第 3 步跑不起来按这个顺序排查别急先按顺序过一遍多数失败都卡在这三步里核对路径三个文件夹是否都落在models下、文件名有没有拼错降精度显存告急就先切 int8 版再试动输入分辨率降一档重新跑一遍三步走完还不行把报错原文留着它比口头描述更有用。文件放对、精度选对MiniMax-H3 部署基本就通了仓库地址回看第 1 步的克隆命令即可。还卡住就把显卡型号、显存大小和完整报错一起贴出去提问定位会快很多。【免费下载链接】MiniMax-H3项目地址: https://ai.gitcode.com/hf_mirrors/Comfy-Org/MiniMax-H3创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考