RTX 5090 跑 MiniMax H3 实测:效率与算力负载关系
Forward-Parsley-148 · reddit · 2026-08-05
测试引入了 MP·s(兆像素·秒) 作为衡量视频生成工作负载的指标,以此评估不同硬件运行 MiniMax H3 模型的效率。
- 线性高效区:在特定负载阈值内,生成时间随 MP·s 增加呈线性增长;超出该阈值后,耗时显著延长。
- 硬件表现:RTX 5070 Ti 在约 2.8 MP·s 内表现稳定(约 70 秒/MP·s);RTX 5090 阈值提升至 4.0 MP·s(约 37.6 秒/MP·s)。
- 极限优化:结合 SageAttention 与 TeaCache 技术,RTX 5090 的阈值可跃升至 10.4 MP·s,且效率提升至约 22.9 秒/MP·s。
结论指出,为了获得最佳生成效率,应尽量将任务负载控制在硬件的线性阈值范围内。
所属事件:MiniMax H3本地实测:多显卡性能与优化指南(13 条相关)→
「Infra」频道最新
- 建立可信算力集群:安全评估前沿 AI 的基础设施构想 — ohlennart · 2026-08-06
- 双 RTX 5060 Ti 挑战本地跑 MiniMax H3:显存切分与卸载策略探讨 — Kahvana · 2026-08-06
- AMD 显卡跑 MiniMax H3 遇阻:SageAttention 依赖成痛点 — itiswhatitiswgatitis · 2026-08-06
- 预告:一个 API 密钥调用任意模型并支持本地云端路由 — ycombinator · 2026-08-06
- turbopuffer 架构解析:如何构建 256TB 搜索索引 — shakoistsLog · 2026-08-06
- 格芯Q3毛利率指引超30%,硅光子产能成AI算力新稀缺资源 — tengyanAI · 2026-08-06