谷歌展示 Gemini Omni Flash:文本音频一键生成多角度视频

kimmonismus · x · 2026-08-07

Google 官方介绍了新模型 Gemini Omni Flash,该模型支持通过文本、图像、视频或音频作为参考,轻松创建和编辑高质量视频。

官方展示了开发者们利用该模型实现的创意项目,重点突出了其多角度镜头切换能力:用户可以在不丢失原始场景连贯性的情况下,自由改变摄像机角度、切换环境并应用电影级缩放。例如,有开发者利用该功能,从约 20 个不同的视角(包括特写、远景、俯视和仰视等)渲染了同一段人物画面。

所属事件:谷歌展示 Gemini Omni 视频生成模型(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →