Gemini 3.6 Flash 竟与 3.5 Flash 同分
Hesamation · x · 2026-07-21
- 这条帖文拿 Gemini 3.6 Flash 和 3.5 Flash 的分数做对比,调侃它的“巨大进步”其实只是智力分数持平,几乎看不出净提升。
- 配图来自 Artificial Analysis,图里 Gemini 3.6 Flash 和 Gemini 3.5 Flash 都是 50 分,被放在一排模型横评里对照。
- 原帖顺带引用 Google 的说法:3.6 Flash 主打速度、智能、agentic 与多模态任务,但这张图的传播点显然是“花了算力,分数却没涨”。
所属事件:Gemini 3.6 Flash 跑分曝光:性能停滞但效率翻倍(19 条相关)→
「模型」频道最新
- NVIDIA 称 Nemotron 3 Ultra 在 2026 IMO 上拿到 30/42 — NVIDIAAI · 2026-07-22
- Gemma-4-26B-a4B 传在微调对比中压过 Qwen MoE — JLeonsarmiento · 2026-07-22
- OpenAI 传将向美国政界简报下一代模型家族 — kimmonismus · 2026-07-22
- Muse Spark 1.1 在 Text Arena 跑到 1495 分,性价比很突出 — ycombinator · 2026-07-22
- 教授提醒:最先进的大模型正变得无法相互替代 — emollick · 2026-07-22
- 实测吐槽谷歌 Gemini 全家桶:无一款模型能胜任核心工作负载 — bindureddy · 2026-07-22