专题 · FULL STORY

Gemini Omni 1.1 Flash:从曝光到登顶

8 月 27 日网友先在 Google Cloud 控制台发现未发布的 Gemini Omni 1.1 Flash,随后谷歌正式官宣该多模态视频生成与编辑模型,上线 API 并展示 4K 超分与场景扩展能力,最终在 Video Arena 文生视频榜登顶,完成从曝光到发布的完整事件线。

2026-08-27 ~ 2026-08-28 · 3 集 · 22 条

第 1 集 · 未发布的 Gemini Omni 1.1 Flash 现身 Google Cloud(2026-08-27,2 条)

Reddit 用户在 Google Cloud 控制台中发现尚未正式发布的 Google Gemini "Omni 1.1 Flash" 模型,随后又有用户在 Google Cloud 的文档与配额设置中再次发现该模型,其已出现在冷门文档的可用模型列表中。这些迹象预示着该模型可能已经上线,或将在 24 小时内正式发布。

第 2 集 · 谷歌发布 Gemini Omni 1.1 Flash:场景扩展与 4K 输出(2026-08-27,17 条)

谷歌于 8 月 27-28 日正式发布多模态视频生成与编辑模型 Gemini Omni 1.1 Flash,已在 Gemini API 和 Google AI Studio 面向开发者开放。新版本集成 Veo 的创作控制能力,核心升级是场景扩展功能,并配套多项分辨率与控制改进,Flow 与 Gemini App 也获得相应更新。这一 Flash 轻量版本将 Veo 级别的创作控制带入更低成本的模型,明显降低了视频生成的试错门槛。

已确认

  • 官方(@GoogleAI)确认新模型集成 Veo 创意控制,新增 4K 升级、首尾帧控制及 360p 快速草稿生成,最大升级为基于最多 10 秒上下文的场景扩展;同时宣布 Flow 升级与 Gemini App 场景扩展更新
  • 场景扩展能力:可分析此前最多 10 秒素材并延续场景,保持角色身份、灯光和叙事背景的一致性(@shlomifruchter 转述);场景可扩展至 40 秒,支持以 10 秒为增量扩展(@OfficialLoganK、@philschmid 转述);视频理解总时长也提升至 40 秒,并支持关键帧提取(@osanseviero)
  • 控制能力:可指定视频首帧与尾帧、以 3 秒视频作为参考输入、帧插值,并支持添加多个视频参考(@chrisfirst、@legitapi 等);@legitapi 称内部代号为 Omni 1.2
  • 分辨率与成本:支持 1080p 与 4K 输出,360p 草稿模式用于低成本快速生成后再放大至 4K
  • @philschmid 补充更新包含更干净的运动效果;@OfficialLoganK 将其描述为"万物入,万物出"的世界模型

为什么重要

  • 这是 Omni 系列 Flash 轻量版本的重要迭代,将 Veo 级别的创作控制带入更低成本的模型,配合 360p 草稿加 4K 放大的工作流,可显著降低视频生成的试错成本
  • 角色一致性与以 10 秒为增量的场景扩展(最长 40 秒)面向叙事类长视频制作场景,是谷歌在视频生成领域与竞品竞争的关键能力

第 3 集 · Gemini Omni 1.1 Flash 文生视频登顶图生视频第二(2026-08-28,3 条)

Google 的 Gemini Omni 1.1 Flash 在视频生成竞技场(Video Arena)表现强劲:拿下文生视频第一名,1.1 新版超过此前的领先模型;在图生视频分榜中以 1488 分位列第二。该模型在视频生成两大细分赛道均跻身前列。