Gemini 3.6 Flash 跑分曝光:性能停滞但效率翻倍
Artificial Analysis 近日发布了 Google 新模型 Gemini 3.6 Flash 与 3.5 Flash-Lite 的完整基准测试结果。数据显示,新模型在智力得分上并未带来惊喜,但在运行效率与成本控制上实现了显著优化。由于核心性能停滞,外界开始质疑 Google 在大模型竞赛中的研发节奏是否已经落后。
性能表现与竞品对比
根据 Artificial Analysis 的榜单,Gemini 3.6 Flash 获得了 50 分的智力评分,其 Elo 分数达到 1421。但在关键的智力测试中,它的成绩与上一代的 Gemini 3.5 Flash 完全持平。多位网友指出该模型缺乏实质性提升,且在榜单上落后于 Meta Spark 1.1、GPT-5.6 Sol 以及 Grok 4.5 等竞品。此外,对比图表显示 Gemini 3.6 Flash 的使用成本甚至高于 GPT-5.6 Sol medium 和 Grok 4.5,但智能水平反而更低。
效率提升与成本优化
尽管绝对性能未见突破,Gemini 3.6 Flash 在效率上表现亮眼。据 Artificial Analysis 分享的数据,该模型的输出速度达到约 304 token,平均每任务耗时降至前代的一半。同时,单任务成本从 $0.59 降至 $0.50。实测体验也印证了这一点,认为 3.6 Flash 的 Token 效率确实略优于 3.5 版本。不过,Gemini 3.5 Flash-Lite 虽然速度变快,单任务成本却出现了翻倍的情况。
市场评价与争议
面对性能停滞但效率提升的现状,用户评价出现分化。有观点认为,该模型是否值得使用完全取决于实际效率;如果效率不够高,将 GPT-5.6 Sol 的 reasoning effort 调低可能是更好的替代方案。此外,通过整理基准对比表,直观展示了 Gemini 3.6 Flash 在定价、编码及代理任务等维度与 GPT-5.6 Luna、Claude Fable 5、Grok 4.5 等前沿模型的综合差距。
2026-07-21 ~ 2026-07-22 · 19 条相关
- 第 1 集:传谷歌将推Gemini 3.6 Flash,主打降价提分(2026-07-21,8 条)
- 第 2 集:Gemini 3.6 Flash翻车:错误描述自家最新模型(2026-07-21,2 条)
- 第 3 集:谷歌发布三款 Gemini 新模型,主打更省 token 且更便宜(2026-07-21,65 条)
- 第 4 集:Gemini 3.6 Flash 跑分曝光:性能停滞但效率翻倍(2026-07-21,19 条)
- 第 5 集:Google启动Gemini 4预训练,3.5 Pro正合作测试(2026-07-21,13 条)
- 第 6 集:Google发布Gemini 3.5 Flash Cyber安全模型(2026-07-22,2 条)
- Gemini 3.6 Flash 的关键还是效率 — Angaisb_ · 2026-07-21
- 【源头】Artificial Analysis 更新榜单,Gemini 3.6 Flash 得 50 分 — Angaisb_ · 2026-07-21
- 图表称 Gemini 3.6 Flash 比 GPT-5.6 Sol medium 更贵 — Angaisb_ · 2026-07-21
- 跑分对比:Gemini 3.6 Flash 与 3.5 Flash 成绩持平 — truecakesnake · 2026-07-21
- Artificial Analysis 图表对比 Gemini 两款 Flash 模型 — Expensive_Syrup_6529 · 2026-07-21
- 实测:Gemini 3.6 Flash Token 效率略优于 3.5 — scaling01 · 2026-07-21
- Gemini 3.6 Flash 与 3.5 分数持平,还落后多款新模型 — Rare_Bunch4348 · 2026-07-21
- Gemini 3.6 Flash 竟与 3.5 Flash 同分 — Hesamation · 2026-07-21
- Gemini 3.6 Flash 任务时间减半,3.5 Flash-Lite 也更快但更贵 — ArtificialAnlys · 2026-07-21
- 【源头】Gemini 3.6 Flash 单任务更便宜,3.5 Flash-Lite 成本却翻倍 — ArtificialAnlys · 2026-07-21
- Artificial Analysis 给 Gemini 3.6 Flash 排到 1421 Elo — ArtificialAnlys · 2026-07-21
- Gemini 3.6 Flash 与 3.5 Flash-Lite 基准结果公布 — ArtificialAnlys · 2026-07-21
- 【源头】Artificial Analysis 显示 Gemini 双模型提升了智能体工作表现 — ArtificialAnlys · 2026-07-21
- 基准表对比 GPT-5.6 Sol、Claude Fable 5 和 Gemini 3.6 Flash — iruletheworldmo · 2026-07-22
- Gemini 3.6 Flash 在 Artificial Analysis 上追平 3.5 Flash — airesearch12 · 2026-07-22
- Gemini 3.6 Flash 基准流出,Google 被质疑落后 — minxio_ · 2026-07-22
- 基准图对比 GPT-5.6 Luna、Grok 4.5 和 Gemini 3.6 Flash — iruletheworldmo · 2026-07-22
- Gemini 3.6 Flash 智能分数持平 3.5,任务时间更短 — ziv_ravid · 2026-07-22
- Gemini 3.6 Flash 同任务成本竟高于 Grok 4.5 — XFreeze · 2026-07-22