H3 的加速分三层,很多教程把它们混在一起讲,导致"为什么我叠加后没变快/质量崩了"。 先记住三个类别:步数蒸馏(减少采样步数)、注意力后端(加速每步计算)、缓存(跳过部分计算)。
| 方案 | 步数 | 相对速度 | 特点与依赖 |
|---|---|---|---|
| 官方基线 | 20 | 1.0× | 质量最稳,最慢 |
| LightX2V Turbo | 8 / 4 | 约 2.1× / 3.4× | 官方内置 turbo_mode;4 步细节略降,社区最常用 |
| larryvrh Turbo v4 | 8 | 约 2.1× | 需要双时钟采样器(音频双调度),口碑好 |
| FastH3(FastVideo) | 4 | 约 4× | DMD2 + VSA 稀疏蒸馏;ComfyUI 需用转换版 LoRA |
| TaoMate-H3 | 3 | 最快档 | 面向流式长视频,质量代价较大 |
| 阿里 PAI PDD | 8 / 4 | 约 2× | 官方蒸馏;必须用专用节点、专用 sigmas,不能叠加其他蒸馏 |
EasyCache / Spectrum 这类步缓存可以再省 15-40% 时间,但属于"跳过部分计算", 需要抽检画面;与 PDD 冲突(会打乱 PDD 的 sigma 边界)。 条件缓存(如 CLIPCached)是无损的:同一提示词连续出多个种子时,第二次开始能省掉整个文本编码阶段。
| 你的目标 | 推荐组合 |
|---|---|
| 快速抽卡 | LightX2V 4 步 + Sage(或 Kitchen) |
| 质量与速度平衡 | LightX2V 8 步 / larry 8 步 + Sage |
| 极限速度(可接受质量损失) | FastH3 4 步 + Sage / Sol-Attn |
| 官方蒸馏路线 | PDD 8 步 + 专用节点(不与任何蒸馏/缓存叠加) |
| 同一提示词批量出片 | 上面任意组合 + CLIPCached 条件缓存 |
在 计算器 的第 2 步可以逐项切换这些方案:它会自动提示冲突(比如 PDD 与其他蒸馏不能同选), 并把加速后的耗时反映到结果矩阵里。文件都在 模型下载库 的"加速"分类。