CLSS 闭环流式生成:单卡 3080 跑任意长音视频
nazgut · reddit · 2026-08-26
视频扩散 Transformer 单次只能生成几秒,朴素的分块条件生成在几百帧后就会因曝光偏差累积导致场景崩塌或噪点放大。Reddit 用户 nazgut 提出的 CLSS(Closed-Loop Streaming Synthesis) 把分块交接当作反馈回路来控制:各块共享一个流式隐空间缓冲(SLB)重叠区,使隐空间内存从 O(长度) 降到 O(重叠),并在块间施加轻量修正来对抗漂移,全程不修改任何 transformer 权重。
作者已在 ComfyUI 开源节点:ComfyUI-LTX2.3-CLSS。实测在单张 3080(16GB 显存)上用 ltx-2.3-22b-dev-UD-Q4KS.gguf 量化模型,完成了多场景连续跟随提示词的文生视频,单块 10 秒;音频部分仍在开发中。
所属事件:CLSS 闭环流式合成:单卡 3080 实现任意时长音视频生成(2 条相关)→
「多模态」频道最新
- AI 3D 工作流:分段生成模型,让 Agent 用 Blender 自动组装绑骨 — majidmanzarpour · 2026-08-26
- AI 生成鬼灭之战:宇髄天元大战女性化猗窝座 — eyishazyer · 2026-08-26
- Wan 3 生成孟买美食夜市超写实 30 秒 Vlog — CurieuxExplorer · 2026-08-26
- FLORA 发布 MCP 集成,让 Claude/Cursor 调用多模态生成 — round · 2026-08-26
- WAN 3.0 视频生成上线 Lumen Pro,一次生成 30 秒带配音短片 — aziz4ai · 2026-08-26
- 阿里 Qwen 发布多模态模型 Qwen3.8-Flash-Next — Qwen · 2026-08-26