本地 LLM 与视频生成抢显存?加 VRAM Guard 自动交接
Sn0opY_GER · reddit · 2026-09-10
作者分享了用 Hermes(本地 agent)编排本地 LLM 与 ComfyUI 视频生成的显存管理技巧:
- 让 Hermes 调 ComfyUI 跑 minimax h3 视频生成前,先卸载本地 LLM,并明确要求加一个「VRAM Guard」在生成期间阻止 LLM 重新加载,避免 OOM;生成完再自动加载回来。
- 整条流水线由 Hermes 写脚本:批量发给 Comfy → 卸载模型 → 等待视频完成 → 通过 Telegram 等渠道回传。
- 还支持多工作流串联:发一张手机照片,先用 FLUX.2 编辑,再作为起始图送入 minimax h3 视频工作流,约 100 秒后收到成片。
这样 qwen 27b 长上下文与视频生成可以并行运行,速度几乎不下降。
「编程与Agent」频道最新
- YC 将办「Make Something Agents Want」黑客松,押注 Agent 成新用户 — ycombinator · 2026-09-10
- 微博 VibeLab 赛事收官:2500 件作品 2.4 亿阅读,普通人搓工具成趋势 — dotey · 2026-09-10
- 「下一次 AI 采用潮是 computer use」:Astra 已能接管大部分办公流程 — zephyr_z9 · 2026-09-10
- Stripe 推出 Agentic Treasury,让 AI 代理经用户授权直接动钱 — jeff_weinstein · 2026-09-10
- Meta 收购 Stilla 是押注分发渠道,而非 agent 能力本身 — arthaudm · 2026-09-10
- 独立开发者 3 天用 Fable 5.1 做出多语言儿童绘本应用并开始收费 — GCWebDesigner · 2026-09-10