96GB Blackwell 实测 LTX-2.5:10 秒 1080p 视频耗时 231 秒仅 7 美分
Realistic-Fennel-190 · reddit · 2026-09-23
作者租了一台 RTX PRO 6000 Blackwell(96GB 显存)实测 ComfyUI 的 LTX-2.5 文生视频模板,用默认工作流跑了两组对比。
耗时与成本
- 5 秒 1280x736:两段采样共 69.4 秒
- 10 秒 1920x1088:pass1 45s + pass2 85s,共 231.5 秒,租金约 7 美分
显存真相
- 权重常驻即占 39GB(21GB transformer + 15GB Gemma 文本编码器),10 秒 1080p 推理仅再加约 13GB,峰值 52.5GB
- 结论:吃显存的是权重而非视频长度/分辨率,32GB 卡连加载权重都吃力
其他发现
- 音视频出自同一 latent(ConcatAVLatent/SeparateAVLatent),不是后期拼音轨;提示词中的雨声和火车鸣笛都准确生成
- 1080p 下采样仅占 130 秒,近一半时间花在 VAE 解码与封装;分辨率翻倍后 refine pass 增速最快(5.9x)
- 坑:模板的 CLIPLoader 指向仅 promptenhance 开启时才需要的 4.9GB Gemma 文件,但 ComfyUI 静态校验会标红,需下载或 Ctrl+B 绕过
作者未测试近距离人脸/手部表现,求助社区谁跑过超 10 秒的场景。
「Infra」频道最新
- crabbox 上线 boxd:本地编辑,命令跑在毫秒级启动的隔离微虚拟机 — steipete · 2026-09-23
- AI 数据中心功耗从 5 兆瓦飙到 1000 兆瓦,涨了 200 倍 — Olivier__OG · 2026-09-23
- 开发者用 Rust 写权重流式引擎,RTX 3060 12GB 跑动 FLUX.2 9B — madtune22 · 2026-09-23
- AMD MI355X 每美元性能达 DGX B300 的 1.7 倍 — zephyr_z9 · 2026-09-23
- 云栖大会最大看点不是新模型,而是 AI 全栈生态成型 — manishkhosiya · 2026-09-23
- 本地跑 Qwen3.8-27B:10GB 显存、170ms 延迟、多模态决策 — kyr0x0 · 2026-09-23