Wan 2.2 显存实测:砍帧数不降 OOM,降分辨率一次省 10GB
Realistic-Fennel-190 · reddit · 2026-09-15
作者在单张 RTX 5090 上用官方 ComfyUI Wan 2.2 5B 模板跑了七组对照实验(5 秒 121 帧、24fps、cfg 5.0、固定 seed),用数据揭示一个反直觉结论。
关键发现
- 帧数不影响显存峰值:61/121/181 帧三组,显存峰值完全一样(25,579 MiB)。2.5 秒和 7.5 秒视频占用的显存没有区别
- 分辨率才是主导:从 1280x704 降到 832x480(44% 像素),显存峰值从 25,579 降到 19,083 MiB,一次省约 10GB
- 所以遇到 OOM,缩短视频没用,降分辨率才有效——「我逆着做了好几个月,估计不止我一个人」
耗时与成本(时租约 $0.46/小时)
- 耗时近似线性:time ≈ 24.3s + 6.54s × steps,24 秒是固定成本(文本编码 + VAE 解码 + 写文件);steps 降到 4 以下几乎不再省钱
- 1280x704/121帧/20步:155.3s、29,195 MiB、$0.020;降到 480p 后 $0.007
- 分辨率与帧数对采样耗时的影响都约等于 token 数的 1.85 次方,符合 attention 的理论预期;但从 121 帧加到 181 帧时该规律不成立
其他踩坑
- 29,195 MiB 那组异常偏高,推测是新 prompt 首跑时 6.3GB 文本编码器需要加载,后续复用缓存则稳定在 25,579
- 模板选错会静默生成静态图:注意 SD3 latent 节点、Save Image 结尾、CLIP loader 误设 lumina2 等坑
完整 setup 参数、seed 和 prompt 均在帖中,可复现。
「Infra」频道最新
- 单卡 5090 跑 Qwen3.8-27B:SGLang 全参数调优只换来 82k 上下文 — ni1by2thetrue · 2026-09-15
- 把 4 块 MCU 开发板搬上网:AI 写完固件即时上真芯片测试 — SelfishlyWandering · 2026-09-15
- Grouped Value Attention 分组存值按需重建 Key,压缩 KV Cache — Vishesh Tripathi · 2026-09-15
- jinfer 开源:纯 JVM 实现 AI 推理引擎,CPU 性能比肩 llama.cpp — mukel90 · 2026-09-15
- 无状态故障转移丢失近 100% 上下文,ContinuityBench 提出 99.2% 保持率方案 — its_vayishu · 2026-09-15
- 单周 500 万亿 token 将至,引用图示 LLM 用量持续飙升 — gajesh · 2026-09-15