| 项目 | 值 |
|---|---|
| 文件名 | minimax_h3_ref2va_pruned_bf16.safetensors |
| 组件 | 主模型(扩散模型) |
| 量化 / 格式 | BF16 |
| 大小 | 40.23 GB |
| ComfyUI 目录 | diffusion_models(主模型目录) |
| 来源 | Comfy-Org/MiniMax-H3 |
GTX 1080 Ti 11GB RTX 2060 12GB RTX 2080 Ti 11GB RTX 3060 12GB RTX 3080 10GB RTX 3080 12GB RTX 3080 Ti 12GB RTX 3090 24GB RTX 4060 Ti 16GB RTX 4070 12GB RTX 4070 Super 12GB RTX 4070 Ti 12GB RTX 4070 Ti Super 16GB RTX 4080 16GB RTX 4080 Super 16GB RTX 4090 24GB RTX 4090 D 24GB RTX 5060 Ti 16GB 等 24 张
RTX 3090 24GB RTX 4060 Ti 16GB RTX 4070 Ti Super 16GB RTX 4080 16GB RTX 4080 Super 16GB RTX 4090 24GB RTX 4090 D 24GB RTX 5060 Ti 16GB RTX 5070 Ti 16GB RTX 5080 16GB RTX 5090 32GB RTX 5090 D 32GB RTX 5090 D V2 24GB
RTX 3090 24GB RTX 4060 Ti 16GB RTX 4070 Ti Super 16GB RTX 4080 16GB RTX 4080 Super 16GB RTX 4090 24GB RTX 4090 D 24GB RTX 5060 Ti 16GB RTX 5070 Ti 16GB RTX 5080 16GB RTX 5090 32GB RTX 5090 D 32GB RTX 5090 D V2 24GB
“可行”= 32GB 内存 / fast-disk 下估算状态为 ok 或 warn(warn 意味着需要权重卸载、速度明显变慢)。
文件大小 40.23GB(主模型(扩散模型))。运行时显存需求还取决于分辨率与时长:720p 级短片段通常需要 24GB 以上显存余量;具体到你的卡可在计算器里精算。
diffusion_models(主模型目录)。文件名保持原名,ComfyUI 刷新后即可在对应加载器里选择。
见模型下载库的同类条目与「小显存 INT8/BF16 对比」文章;通用建议:8GB 用 GGUF Q3/Q2,12-16GB 用剪枝 INT8 或 W4A8,24GB+ 可上 INT8 全量或 NVFP4(50 系)。
同类文件:BF16 · INT8 · P- BF16 · P- INT8 · P- FP8 · BF16 · INT8 · P- INT8 · P- FP8 · P- W4A8
相关:模型下载库 · INT8/BF16 对比 · 8GB 显存实战