生数发布 Vidu S2:可对话可实时剪辑的视频生成,实时编辑跑赢离线模型
iamaliveix · x · 2026-09-15
Vidu 团队发布 S2 系列,主打「可以对话、可以导演、可实时编辑」的 AI 视频:
S2-Avatar(实时交互数字人)
- 720p、25–42 FPS 的实时角色,支持语音对话与语音控制的复杂动作(如「为我跳舞」「戴上这顶帽子」)
- 参考图引导的物体交互、换装、换背景,参考内容可随时更新
- 另提供高质量离线数字人
S2-Editing(实时视频流编辑)
- 基于风格/服装/主体/背景参考图,对输入视频流做实时改风格、换人物、换背景、虚拟试穿,且保留原始运动
- 团队称其实时编辑器在基准上超过了所评测的离线编辑器,并在论文基准上达到 SOTA
还探索了带同步双目立体流的实时空间视频生成与编辑,面向 VR 场景。API 与技术报告已开放。
所属事件:生数发布Vidu S2:实时交互可编辑的空间视频生成(9 条相关)→
「多模态」频道最新
- Poolday 融资 1100 万美元,推出能真正读懂软件的 AI 视频 Agent — aryanXmahajan · 2026-09-16
- 用 Invideo Agent 全流程生成的短剧《The Sage》更新至第 7 集 — Kavanthekid · 2026-09-16
- GPT-6 Astra 八个狂野用例:数小时做出游戏、机器人demo和3D管线 — socialwithaayan · 2026-09-16
- 下一部低成本恐怖片,将完全用 tldraw flash 拍成 — max__drake · 2026-09-16
- DGX Spark 本地跑 TRELLIS.2:铅笔草图一键转 3D GLB — jasonkneen · 2026-09-15
- 牛津学者 Sandberg 演示生成艺术与传统媒介结合创作 — anderssandberg · 2026-09-15