为 ComfyUI 长视频序列新增 top_level_requeue 模式,根治内存持续增长
Slight-Living-8098 · reddit · 2026-09-09
作者为 ComfyUI 的 MiniMaxH3 Context Loop 贡献并已合并了一个新执行模式 toplevelrequeue,解决长序列生成时系统 RAM 不断增长的问题。
问题:原方案把整个多场景序列放在一个长驻 ComfyUI prompt 内执行,即使单个场景数据可释放,顶层执行仍存活,旧场景的引用被长期挂住,RAM 随场景数线性攀升。
方案:每个场景完成后保存 checkpoint 和一个轻量的 continuation handoff,然后结束当前顶层 prompt,让 ComfyUI/PyTorch 获得干净的清理边界,再由 Context Loop 自动把下一场景作为全新顶层 prompt 入队。类比「每做完一步就清空工作台并记下进度」,序列连续性靠 checkpoint/handoff 保持。
效果与边界:主要解决系统 RAM;VRAM 可能受益但不保证归零(CUDA/PyTorch 会保留缓存)。作者强调这不是删一个 tensor 就完事,而是要给执行生命周期一个真正的任务边界。
所属事件:ComfyUI 长视频生成新增执行模式,内存占用大降(2 条相关)→
「Infra」频道最新
- Epoch AI:GPT 与 Claude 长上下文定价差异或暴露架构不同 — scaling01 · 2026-09-09
- 百吉瓦算力什么样?一年需 876 太瓦时电、国家级电力系统 — shyamalanadkat · 2026-09-09
- vLLM 硬核复盘:管线并行遇热缓存失效,Kimi K3 解码吞吐 2.7 倍 — vllm_project · 2026-09-09
- vLLM 发布 AgentX 基准实测,全栈优化真实 Agent 推理服务 — vllm_project · 2026-09-09
- 谷歌云 CEO:自研芯片服务器回本周期不到 1 年,约为 GPU 一半 — matt_slotnick · 2026-09-09
- DeepSeek 限时放出 v4.1 Flash:1 美元可烧 5800 万 token — MicahBerkley · 2026-09-09