实测发现:显存够用时动态显存反而拖慢视频生成,留 Qwen 常驻提速 2 倍
Modern_Art_Official · reddit · 2026-09-19
一位 RTX 5090 + 96GB 内存的 Reddit 用户在跑视频生成工作流(Dasiwa 混合模型 + nvfp4 文本编码器 + Kijai 实验版 VAE,5 秒 0.98MP 视频)时偶然发现:
- 常驻加载的 Qwen 3.8 反而让单次生成时间从 350-430 秒降到约 174 秒,卸载后重启 ComfyUI 甚至慢到 430+ 秒。
- 根源在实验版 VAE:即使所有东西本可塞进显存,ComfyUI 的动态显存(dynamic vram)机制仍会被触发,把部分张量挪进慢速 Shared GPU Memory。
- 量化来看:工作流单独运行时占满全部 76.7GB 显存还借用约 0.7GB 共享内存;留 Qwen 常驻时动态显存只用 29.4/76.7GB,跑得飞快但 GPU 温度到 80°C。
结论:留大模型常驻反而"挤占"了动态显存机制,规避了慢速换页。跑本地视频生成的用户可参考这一反直觉配置。
「Infra」频道最新
- DGX Spark 上花 26 小时蒸馏 DeepSeek V4 Flash,4B 小模型单次判断仅 22ms — Dan_Jeffries1 · 2026-09-19
- Positron 融资 8.75 亿美元,播客激辩数据中心泡沫与能源瓶颈 — 20VC · 2026-09-19
- 双 RTX 3060 跑 Qwen3.8-27B 实测数据与 $2000 扩容方案讨论 — gnoremepls · 2026-09-19
- GitHub Next 开源 LocalJev:用 oMLX 本地复刻 Jev 决策 API — gaganghotra_ · 2026-09-19
- 本地模型 Prefill 速度被忽视:API 输入处理到底快多少没人测 — BobtheGodGamer · 2026-09-19
- VanEck:NVDA 财报风险在缺电,电力土地头寸基准看涨约 83% — menhguin · 2026-09-19