交互式实时视频生成原型
AI_Andrew · x · 2026-07-17
作者用 **Omni** 原型化了一个“未来的画板/万花筒”式交互:用户可以像直接操控素材一样,尝试编辑和驱动**实时视频生成**。 这条帖子的重点不是正式产品发布,而是一个能帮助理解“交互式视频生成”可能长什么样的实践演示:把多模态生成从“输入提示词”推进到“直接操作内容”。
「多模态」频道最新
- Apple-PI 评测 11 个视频模型的物理推理上限仅 0.473 — mmlab-ntu · 2026-07-21
- 字节 FlowMimic 用模态模仿训练无 mask 视频编辑 — ByteDance-Seed · 2026-07-21
- 有人称免费版 Qwen Studio 图像生成几乎没变化 — teortaxesTex · 2026-07-21
- 腾讯 ProLaViT 用渐进隐空间链提升多模态推理 — 机器之心 · 2026-07-21
- 阿里发布 Qwen-Image-3.0,支持 4.5k token 和 12 种语言渲染 — Scobleizer · 2026-07-21
- 写实人像体型编辑用什么 img2img 模型最好 — throwaway0204055 · 2026-07-21