fofrAI 分享 Gemini Omni Flash 视频延展与标签引用实操指南

fofrAI · x · 2026-09-04

fofrAI 分享了关于 Gemini Omni Flash 视频编辑的两点实操指南:如何延展(extend)已有视频,以及如何在 prompt 中用标签标记输入内容(区分作为参考素材与待编辑视频)。Gemini Omni Flash(gemini-omni-1.1-flash)是 Google 面向高速视频生成、编辑与电影化控制的多模态模型:原生处理文本/图像/音频/视频,支持通过 Interactions API 进行自然语言对话式编辑,并在生成中保留想保留的片段;同时结合物理理解与 Gemini 的世界知识,支持文生视频(含音频)、镜头/光照/氛围控制等。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →