Google 推出主动视频理解:token 省 88%、成本降 66%、准确率升 7%

APPSO · wechat · 2026-09-03

Google 9 月 1 日为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 三款模型接入「主动视频理解」功能,让 AI 自主决定看哪段画面、以什么速度看、依赖画面/音频还是字幕,告别传统每秒固定抽帧导致瞬态动作被漏掉的问题。开发者此前需写胶水代码手动拼这种逻辑,现由模型原生接管。

所属事件:Gemini 推出 Agentic Video:token 省 88%、成本降 66%(28 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →