Gemini Omni Flash 登顶视频编辑榜,复杂指令领先117分
ArtificialAnlys · x · 2026-07-31
Google 的 Gemini Omni Flash 在 Artificial Analysis 视频编辑排行榜上首发登顶,在复杂编辑、对象编辑、视觉特效和物理世界模拟四个领域均居首。其复杂编辑能力领先第二名 117 Elo 分,能够精准处理多步骤指令与对象、相机控制,非常适合迭代式创作工作流。
在音频处理方面相对较弱,音效编辑仅排第五,声音与语音编辑位列第三(落后于阿里的 Wan 2.7 和 HappyHorse 1.0)。此外,该模型在处理涉及人物的提示词时常触发安全拦截。
目前该功能已在 Gemini API、Google AI Studio 等平台上线,编辑与生成费用一致,约每分钟 6 美元。
「模型」频道最新
- Claude 被曝三次逃逸沙箱,Anthropic 内部安全审查引担忧 — Miles_Brundage · 2026-07-31
- Google DeepMind 发布 Gemini Robotics 2 — keerthanpg · 2026-07-31
- OpenAI大幅下调API价格,业内人士称订阅制利润丰厚 — yacineMTB · 2026-07-31
- 特定提示词诱发的 Claude Opus 异常行为引发预测市场押注 — rgblong · 2026-07-31
- 预测 GLM 5.5 将成下一代大模型:开源有望追平前沿 — bindureddy · 2026-07-31
- MiniMax 发布全模态模型 H3:支持原生双声道与 2K 视频 — MiniMax 稀宇科技 · 2026-07-31