Gemini 视频 token 省 88% 的关键更新落在 3.7 Flash 而非 3.8
Servola-Journal · reddit · 2026-09-03
Google 于 9 月 1 日向 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 推送了 agentic 视频理解能力,次日才发布大家热议的 3.8 Flash——但作者认为真正影响成本的是前者。
核心变化:模型不再按固定速率逐帧采样,而是自主选择看哪些片段、读帧、音频还是字幕。Google 宣称最多减少 88% token、降低 66% 成本,且 API 定价不变,这让摄像头画面审查从预算大头变成零头。
作者保留意见:「准确率最高提升 7%」的表述没有说明测试条件,而一个会主动跳过内容的模型,理应漏掉固定扫描能捕捉的东西,准确率宣称可能是软肋。他呼吁有人用已知内容的长视频实测验证。
所属事件:Gemini 上线智能体视频理解:Token 消耗最高降 88%(29 条相关)→
「模型」频道最新
- 开发者称 GPT 电脑操作能力领先,Anthropic 远远落后 — CtrlAltDwayne · 2026-09-03
- 疑似 GPT-6 曝光:分支命名现踪迹,主攻 computer use 能力 — scaling01 · 2026-09-03
- GPT-5.6 会学你说话的腔调,被赞比 Claude 更有人味 — CtrlAltDwayne · 2026-09-03
- 前 OpenAI 政策总监吐槽:Fable 5.1 在实际工作流中极度费 token — Miles_Brundage · 2026-09-03
- 全自动开源模型追踪站上线:新 HF 模型 1 天内收录并给出理论最高 tok/s — helloiamleonie · 2026-09-03
- 传 Google Astra 今日发布,各家实验室为何扎堆抢发新模型 — haider1 · 2026-09-03