H3 加速方案横评:怎么选、能不能叠加

更新于 2026-09 · 速度数据来自公开实测与本站回归

H3 的加速分三层,很多教程把它们混在一起讲,导致"为什么我叠加后没变快/质量崩了"。 先记住三个类别:步数蒸馏(减少采样步数)、注意力后端(加速每步计算)、缓存(跳过部分计算)。

第一层:步数蒸馏(只选一个!)

方案步数相对速度特点与依赖
官方基线201.0×质量最稳,最慢
LightX2V Turbo8 / 4约 2.1× / 3.4×官方内置 turbo_mode;4 步细节略降,社区最常用
larryvrh Turbo v48约 2.1×需要双时钟采样器(音频双调度),口碑好
FastH3(FastVideo)4约 4×DMD2 + VSA 稀疏蒸馏;ComfyUI 需用转换版 LoRA
TaoMate-H33最快档面向流式长视频,质量代价较大
阿里 PAI PDD8 / 4约 2×官方蒸馏;必须用专用节点、专用 sigmas,不能叠加其他蒸馏
蒸馏类方案只能选一个:它们都改变了采样轨迹,叠加会互相破坏效果,还各自占显存。 PDD 还需要额外的自定义节点包(可直接读取官方原版文件)。

第二层:注意力后端(可以叠加)

第三层:缓存(有质量代价)

EasyCache / Spectrum 这类步缓存可以再省 15-40% 时间,但属于"跳过部分计算", 需要抽检画面;与 PDD 冲突(会打乱 PDD 的 sigma 边界)。 条件缓存(如 CLIPCached)是无损的:同一提示词连续出多个种子时,第二次开始能省掉整个文本编码阶段。

组合建议

你的目标推荐组合
快速抽卡LightX2V 4 步 + Sage(或 Kitchen)
质量与速度平衡LightX2V 8 步 / larry 8 步 + Sage
极限速度(可接受质量损失)FastH3 4 步 + Sage / Sol-Attn
官方蒸馏路线PDD 8 步 + 专用节点(不与任何蒸馏/缓存叠加)
同一提示词批量出片上面任意组合 + CLIPCached 条件缓存

计算器 的第 2 步可以逐项切换这些方案:它会自动提示冲突(比如 PDD 与其他蒸馏不能同选), 并把加速后的耗时反映到结果矩阵里。文件都在 模型下载库 的"加速"分类。