MiniMax H3 加速实测:TE-Speed 最高提速1.785倍
Commercial_Board9219 · reddit · 2026-08-04
开发者开源了在 Google Colab G4 上测试 MiniMax H3 视频模型的部署与基准测试工具包,对比了原生、Spectrum 和 TE-Speed 三种模式的加速表现。
核心测试结果:
- TE-Speed 加速:在开启 SageAttention 的前提下,TE-Speed 相比原生模式最高可实现 1.785 倍提速(耗时减少 44%),且纯 Python 实现无需编译 CUDA 扩展。
- Spectrum 表现:能显著降低端到端生成时间,但与原生模式的对比中混入了 SageAttention 优化的影响。
- 兼容性问题:目前 TE-Speed 与 Spectrum 无法叠加使用。TE-Speed 会跳过尾部 transformer 块,而 Spectrum 依赖这些块的执行,两者底层假设冲突导致报错。
测试环境与开源内容:
- 硬件基于 NVIDIA RTX PRO 6000 Blackwell(97GB 显存),PyTorch 2.11 + CUDA 12.8。
- 仓库不仅提供复现脚本,还包含了 ComfyUI 工作流、原生与加速后的 MP4 样片、视觉对比图及机器可读的基准 JSON 日志。
「Infra」频道最新
- 成立7个月获30亿美元融资,Volta携百亿Anthropic订单入场 — matt_slotnick · 2026-08-04
- 128核CPU集群跑Codex:算力新解法 — BenBajarin · 2026-08-04
- Nscale 向牛津、UCL 等高校赞助百万美元算力 — _rockt · 2026-08-04
- 多模态API图片传输实测:Base64与预签名URL延迟对比 — Nigiva · 2026-08-04
- EON 获 1075 万美元种子轮,拟用卫星激光替代海底光缆 — oyhsu · 2026-08-04
- RTX 3090跑Minimax H3:15秒视频生成耗时22分钟 — pfeifits · 2026-08-04