单张 RTX 5090 跑 MiniMax H3:15 秒视频实测 0.8MP 是极限
Realistic-Fennel-190 · reddit · 2026-10-09
作者在单张 RTX 5090(32GB)上用 ComfyUI 原生模板实测 MiniMax H3 图生视频,固定 15 秒时长逐步提高分辨率直到 OOM:
- 配置:int8 量化 unet(20GB)+ qwen3vl 32b 文本编码器 + int8 VAE,叠加 lightx2v turbo LoRA,8 步出片,90GB 内存做 cgroup 限制支撑动态权重卸载
- 结果:0.6MP 476s、0.7MP 590s、0.8MP 746s;0.9MP 在第 2 步 OOM(激活分配超出,即使动态加载也不够)
- 发现:VRAM 在各分辨率下几乎都顶到 31.7GB,所以 s/it 更能反映差异;提示词内容不影响速度,只有分辨率和时长影响
- 画质权衡:分辨率改变 latent 尺寸即改变噪声,相当于重新抽卡——0.6 动作和配乐最好但偏软,0.8 整体最佳
- 提示词技巧:按时间段(0-4s/4-8s/8-12s/12-15s)分段写动作,每段一个小重复动作
未测试 turbo 关闭、--reserve-vram 等选项,作者在评论区求 0.9MP@15s 的可行方案。
「Infra」频道最新
- TRL v1.15 融合 LM head,峰值显存省 82%、序列长 7 倍 — QGallouedec · 2026-10-09
- 在核显上跑 22B 视频模型 LTX-2.5:权重留 NVMe 逐层流式加载 — Business_Swordfish_5 · 2026-10-09
- 亚太数据中心缺口 2800 亿美元,柔佛成最大新建市场 — shashib · 2026-10-09
- Stepped MoE 论文:单个模型可缩放为 1-4B,端侧精度反超同级稠密模型 — pmttyji · 2026-10-09
- DLoop 循环式投机解码:目标模型前向减少,实测加速提升 5-41% — pmttyji · 2026-10-09
- OpenTelemetry 提出原生可观测设计:产品天然可对接任意观测栈 — dhruv_ahuja · 2026-10-09