RTX 5090 对比多款显卡:本地跑视频生成模型性能实测
prompt_seeker · reddit · 2026-08-06
一位开发者实测了多款主流显卡运行 MiniMax H3 I2VA 视频生成模型(544x800 分辨率,5秒时长)的性能差异。
测试结果亮点:
- RTX 5090(限功耗 400W):采样耗时 55.6 秒,总耗时约 1 分钟。
- RTX 3090:采样耗时 2 分 22 秒。
- AMD R9700:耗时 3 分 03 秒,虽不及 3090,但考虑到 RX 9070XT 的预期表现,AMD 的性价比正在提升。
- RX 7900XT:耗时超 5 分钟,部分受限于 PCIe 4.0 x4 带宽及缓慢的 VAE 解码。
- RTX 3060:耗时约 9 分钟。
- Intel B580:经过 3 小时排障仍无法稳定运行。
技术细节:
- 即便在显存充足的 5090 上,开启动态 VRAM(Dynamic VRAM)依然能提升效率。
- AMD 显卡使用 --disable-pinned-memory 参数有助于提升性能。
- Sage Attention 在 R9700 上表现更好,而 Flash Attention 更适合 RX 7900XT。
「Infra」频道最新
- RTX 3090 实测:INT8 量化让 MiniMax 视频生成提速翻倍 — Nevaditew · 2026-08-06
- 语音 AI 代理推理优化:为何 Serverless 平台难以支持? — Comprehensive_Quit67 · 2026-08-06
- Together AI 上线 Kimi K3 推理服务,多项基准测试领先 — togethercompute · 2026-08-06
- RTX 3090 跑 MiniMax H3 实测:INT8 比 FP8 快一倍且画质无损 — Nevaditew · 2026-08-06
- 后训练优化任务 Token 效率,可直接降低 10% 推理成本 — ypatil125 · 2026-08-06
- Jeff Dean 等科学家因 TPU 限制研究而离开 Google — firstadopter · 2026-08-06