MiniMax H3 常见报错排查手册

更新于 2026-09 · 按"现象 → 原因 → 解决"整理,全部来自社区实测

一、画面类问题

现象原因解决
输出纯黑画面 INT8 ConvRot 的 VAE 需要新版内核;fp16 手动转换在部分卡上溢出 升级 ComfyUI ≥0.31(含 int8 VAE 支持);用 --fp16-unet 黑屏的卡(V100 等)需要专门的 fp16 修复补丁
长片段出现灰色噪点/雪花 SageAttention 在超长序列(约 16 万 token 以上)有静默噪声 bug 长片改用 comfy-kitchen 注意力后端,或 KJNodes 的 Patch Sage 节点,或缩短时长分段生成
视频模糊 / 有接缝方块 VAE 解码显存不足时静默回退到分块解码 降低峰值需求(关掉其它占显存程序),或直接降低分辨率;不要硬拉高分辨率抽卡

二、音频类问题

现象原因解决
声音断续 / 爆音 / 词错 视频与音频是两条采样调度;步数太少时音频被过度采样(尤其 4 步) 换 6-8 步,或使用支持双时钟调度的采样器(larry LoRA 必须配双时钟采样器)
音频抽样参数建议 官方模板默认值与蒸馏 LoRA 不完全一致 常用组合:video sigma shift 12 / audio shift 3;采样器 res_multistep 或 euler + simple
旧版本音频全错乱 ComfyUI 0.30 之前音频在采样器里的传递方式不同 升级到 ≥0.30(首次修复合并),建议直接用 0.34+

三、速度与显存类问题

现象原因解决
显存不足 OOM 权重 + 激活值 + 缓存超限 --lowvram;降分辨率/时长;换更低量化(GGUF Q3/Q4、W4A8);关闭浏览器硬件加速等占显存程序
速度远低于预期 注意力后端没开 / LoRA 每步重打补丁 / 走了页文件 用 Sage 或 Kitchen 注意力;低显存 + 量化 + LoRA 时优先用「融合了 LoRA 的权重」(省掉每步 patch);任务管理器确认没有大量页文件读写
一条比一条慢,最后崩溃 ComfyUI 在故障前会先降速(约 1.8×),常见于长时间连续采样 发现规律性变慢就重启 ComfyUI;批量出片拆成批任务,中间重启一次
切换 LoRA 节点后爆显存 Turbo 采样节点与原生节点切换时旧显存不释放 切换前重启 ComfyUI(社区踩坑记录最多的一个)

四、加载与兼容类问题

现象原因解决
Windows 读取大模型崩溃 mmap 读取超过 20GB 的 safetensors 会崩 启动加 --disable-mmap(ComfyUI ≥0.31)
LoRA 加载了但没效果 diffusers 格式的 H3 LoRA 不能直接用于 ComfyUI(键位不同) 用经过验证的转换版(qkv 融合、fc1 半边互换),不要用原版 diffusers 文件
GGUF 报形状错误 / 与内存优化节点冲突 部分优化节点会把 GGUF 容器形状当成权重形状读 GGUF 场景不要叠加此类内存优化节点;用平台自带的卸载策略
找不到 MiniMax H3 节点 版本太旧 升级 ComfyUI ≥0.30(0.30.0 起原生支持),模板库 → Video 里选 H3 工作流
显存峰值居高不下 ComfyUI 的动态显存会顶到上限运行,属正常行为 不用恐慌;看的是"是否触发页文件/是否 OOM",而不是峰值数字本身

五、一分钟自查清单

  1. ComfyUI 版本 ≥0.30(建议 0.34+)、PyTorch cu130、注意力后端已开;
  2. 启动参数含 --fast-disk(内存紧张)与 --disable-mmap(Windows);
  3. 任务管理器确认采样时没有持续大量磁盘读写(有 → 内存不足,加内存或降量化);
  4. 长片段用 Kitchen 类注意力;4 步蒸馏只用于抽卡;
  5. 换了采样节点/LoRA 组合后,重启一次 ComfyUI。

显存和时间的预期,可以先在 WhichH3 计算器 里按你的硬件跑一遍, 确认"应该花多久、应该用多少显存",再对照实际表现定位问题。

相关页面: 全部显卡档位 · 全部模型文件 · 加速方案横评