首页 / 模型速查 / GGUF Q8

MiniMax H3 GGUF Q8:适用显卡、显存与下载

主模型(扩散模型) · GGUF · 21.58GB · 剪枝版 · 更新于 2026-09-18

项目
文件名MiniMax-H3-FL2VA-Pruned-Q8_0.gguf
组件主模型(扩散模型)
量化 / 格式GGUF
大小21.58 GB
ComfyUI 目录diffusion_models(主模型目录)
来源Abiray/MiniMax-H3-Pruned-GGUF
GGUF 中质量最高档,体积已接近 int8 convrot

什么显卡能跑

736 × 416 · 5 秒:40 张卡可行

GTX 1060 6GB GTX 1070 8GB GTX 1080 8GB GTX 1080 Ti 11GB RTX 2060 6GB RTX 2060 12GB RTX 2060 Super 8GB RTX 2070 Super 8GB RTX 2080 Ti 11GB RTX 3050 8GB RTX 3060 8GB RTX 3060 12GB RTX 3060 Ti 8GB RTX 3070 8GB RTX 3070 Ti 8GB RTX 3080 10GB RTX 3080 12GB RTX 3080 Ti 12GB 等 40 张

1344 × 768 · 5 秒:39 张卡可行

GTX 1070 8GB GTX 1080 8GB GTX 1080 Ti 11GB RTX 2060 6GB RTX 2060 12GB RTX 2060 Super 8GB RTX 2070 Super 8GB RTX 2080 Ti 11GB RTX 3050 8GB RTX 3060 8GB RTX 3060 12GB RTX 3060 Ti 8GB RTX 3070 8GB RTX 3070 Ti 8GB RTX 3080 10GB RTX 3080 12GB RTX 3080 Ti 12GB RTX 3090 24GB 等 39 张

1344 × 768 · 15 秒:28 张卡可行

RTX 3060 12GB RTX 3060 Ti 8GB RTX 3070 8GB RTX 3070 Ti 8GB RTX 3080 10GB RTX 3080 12GB RTX 3080 Ti 12GB RTX 3090 24GB RTX 4060 Ti 8GB RTX 4060 Ti 16GB RTX 4070 12GB RTX 4070 Super 12GB RTX 4070 Ti 12GB RTX 4070 Ti Super 16GB RTX 4080 16GB RTX 4080 Super 16GB RTX 4090 24GB RTX 4090 D 24GB 等 28 张

“可行”= 32GB 内存 / fast-disk 下估算状态为 ok 或 warn(warn 意味着需要权重卸载、速度明显变慢)。

下载 · HuggingFace →

→ 在计算器里按你的内存/预算精算(已预填此文件)

常见问题

MiniMax-H3-FL2VA-Pruned-Q8_0.gguf 需要多大显存?

文件大小 21.58GB(主模型(扩散模型))。运行时显存需求还取决于分辨率与时长:720p 级短片段通常需要 13GB 以上显存余量;具体到你的卡可在计算器里精算。

这个文件放在 ComfyUI 哪个目录?

diffusion_models(主模型目录)。文件名保持原名,ComfyUI 刷新后即可在对应加载器里选择。

和同类的其他量化比,选哪个?

见模型下载库的同类条目与「小显存 INT8/BF16 对比」文章;通用建议:8GB 用 GGUF Q3/Q2,12-16GB 用剪枝 INT8 或 W4A8,24GB+ 可上 INT8 全量或 NVFP4(50 系)。

同类文件:BF16 · INT8 · P- BF16 · P- INT8 · P- FP8 · BF16 · INT8 · P- BF16 · P- INT8 · P- FP8

相关:模型下载库 · INT8/BF16 对比 · 8GB 显存实战