Gemini 视频 token 省 88% 的关键更新落在 3.7 Flash 而非 3.8

Servola-Journal · reddit · 2026-09-03

Google 于 9 月 1 日向 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 推送了 agentic 视频理解能力,次日才发布大家热议的 3.8 Flash——但作者认为真正影响成本的是前者。

核心变化:模型不再按固定速率逐帧采样,而是自主选择看哪些片段、读帧、音频还是字幕。Google 宣称最多减少 88% token、降低 66% 成本,且 API 定价不变,这让摄像头画面审查从预算大头变成零头。

作者保留意见:「准确率最高提升 7%」的表述没有说明测试条件,而一个会主动跳过内容的模型,理应漏掉固定扫描能捕捉的东西,准确率宣称可能是软肋。他呼吁有人用已知内容的长视频实测验证。

所属事件:Gemini 上线智能体视频理解:Token 消耗最高降 88%(29 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →