Google 发布 Gemini Omni Flash:支持多模态生成与运镜控制
shlomifruchter · x · 2026-08-10
Google 官方介绍了其 Omni 家族的首款模型 Gemini Omni Flash。该模型支持通过文本、图像、视频或音频作为参考素材,轻松生成和编辑高质量视频。
自向开发者开放以来,社区已经探索出多种实用玩法。例如,开发者能够利用该模型在不丢失原始场景连贯性的前提下,自由切换摄像机视角、改变环境以及应用电影级缩放。已有创作者结合这些能力,生成了包含约 20 种不同视角(包含远近、正面侧面、俯仰拍等)的连贯人物动态视频。
「模型」频道最新
- Gary Marcus 批媒体混淆概念:Meta 新模型是开放权重非开源 — GaryMarcus · 2026-08-10
- Motif 3 技术报告解析:GDLA 注意力与路由噪声机制 — eliebakouch · 2026-08-10
- Gary Marcus 长文:开放权重不等于开源,批 Meta 借机营销 — Gary Marcus · 2026-08-10
- 0.21美元处理过亿Token:NousResearch API定价引热议 — Teknium · 2026-08-10
- Google 官方 SDK 惊现 Gemini 3.7 Flash,或即将发布 — koltregaskes · 2026-08-10
- Red Hat AI 推出 Muse-Glimmer 30B 的 FP8 量化版,显存占用减半 — vllm_project · 2026-08-10