开源AI画布串起图生视频流程
GeeseHomard · reddit · 2026-07-18
有人分享了一个开源的 AI 画布项目,特点是把图像到视频的多步流程放在同一个可复用的 graph 里管理,减少多工具切换的混乱感。它的工作方式包括:
- 用内置 3D Director 先做镜头 blocking,可设定角色、姿势、机位和简单几何
- 把构图送进图像生成节点
- 再把图像结果复用为视频生成的参考图、首帧或尾帧
- 所有中间结果都保留在同一张无限画布上
- 支持在浏览器里保存 graph,或导出为 JSON
项目支持的图像模型包括 GPT Image、Nano Banana、Seedream;视频模型包括 Kling、Seedance、Veo。作者也强调了一个重要限制:应用本身是 MIT 许可、可自托管,但模型不是本地运行,生成与媒体传输依赖付费的 SJolt API,而且 API key 和图谱会保存在浏览器里。帖子最后还抛出一个问题:对于做图生视频的人,这种内置 3D blocking 会不会取代一部分 Blender/ComfyUI 流程,还是云 API 依赖会直接劝退。
所属事件:开源AI画布整合图生视频与3D构图工作流(2 条相关)→
「编程与Agent」频道最新
- 用 Agent 造小分类器:19 万文档标注成本仅 0.7 美元 — vanstriendaniel · 2026-09-11
- MathModelAgent 走红:自动完成数学建模并生成可提交论文 — jihe520 · 2026-09-11
- alphaXiv 开源 OpenResearch:用任意模型并行跑研究智能体 — alphaXiv · 2026-09-11
- 开源 AI 销售 OS DeskcommCRM 爆火:自带 Agent 与 WhatsApp 集成 — melgarafael · 2026-09-11
- hyperresearch 开源:让 Agent 把网络调研沉淀为可搜索知识库 — jordan-gibbs · 2026-09-11
- Forter 两周全员 Agent 冲刺 13 条经验:跳过自建 RAG 靠企业搜索 — bibryam · 2026-09-11