Google DeepMind 推出 Gemini 3.6 Flash,质量更高且更省 token
GoogleDeepMind · x · 2026-07-22
Gemini 3.6 Flash 直接基于 3.5 Flash 的反馈迭代,Google DeepMind 这次把重点放在“更强质量 + 更省 token”上。
配图展示了它在多项 agentic 任务上的提升,包括:
- 长程软件工程:DeepSWE v1.1 从 3.5 Flash 的 37% 提升到 3.6 Flash 的 49%
- 机器学习工程:MLE-Bench 从 49.7% 提升到 63.9%
- 知识工作:GDPval-AA v2 从 1349 提升到 1421
- 电脑操作:OSWorld-Verified 从 78.4% 提升到 83.0%
官方同时表示,3.6 Flash 已在 Gemini App 中逐步上线,开发者可通过 Antigravity 开始构建,也可在 Google AI Studio 和 Android Studio 获取 API 访问。
所属事件:谷歌发布三款Gemini新模型,主打更省token与更低价格(67 条相关)→
「模型」频道最新
- DeepSWE评测:Kimi K3达到Claude Fable 5同等能力,成本仅35% — togethercompute · 2026-07-22
- 实测对比:Gemini 3.5 Flash在轻量编程任务中优于GPT-5.6 — Shick_hydro · 2026-07-22
- NVIDIA 称 Nemotron 3 Ultra 在 2026 IMO 上拿到 30/42 — NVIDIAAI · 2026-07-22
- Gemma-4-26B-a4B 传在微调对比中压过 Qwen MoE — JLeonsarmiento · 2026-07-22
- OpenAI 传将向美国政界简报下一代模型家族 — kimmonismus · 2026-07-22
- Muse Spark 1.1 在 Text Arena 跑到 1495 分,性价比很突出 — ycombinator · 2026-07-22