4090 实测 MiniMax H3:Sage Attention 节点让生成时间暴降
thegr8anand · reddit · 2026-08-05
作者在 4090 + 32GB 内存的本地环境下,详细测试了不同 ComfyUI 节点组合对 MiniMax H3 视频模型生成耗时的影响。
核心结论
- H3 Mem Eff Sage Attention 节点优化效果最为显著,单步耗时从默认的 12-13 秒降至 8-8.5 秒,整体生成时间从 316 秒缩短至 210 秒左右。
- Sol Attention 表现尚可,但不如前者;而 Patch Sage Attn 和 TorchCompile 等老节点提升有限甚至可能导致不稳定。
- 画质表现:上述优化节点在提速的同时,基本保持了与默认工作流一致的输出质量。
部署指南
- 提供了在 Windows ComfyUI 便携版下安装 Triton 和 SageAttention 的详细命令与依赖文件链接。
- 需配合 Kijai 的 KJ-Nodes 自定义节点库来实现最佳加速效果。
「Infra」频道最新
- 斯坦福Hazy Research:AI智能体正在让CUDA传统抽象层走向消亡 — HazyResearch · 2026-08-05
- 实测:遵循 AI 投资建议回报尚可,瓶颈在上游 — Afinetheorem · 2026-08-05
- 96GB显存仍爆显?MiniMax-H3视频LoRA训练实战与优化探讨 — isari_chan · 2026-08-05
- Ling-3.0-flash本地实测:单机80 tok/s解码 — niacolhealth · 2026-08-05
- 前NBIS员工爆料:英伟达与Neocloud关系紧张,Meta将出售40万GPU — RihardJarc · 2026-08-05
- Google Cloud API Gateway 支持跨厂商模型路由 — rseroter · 2026-08-05