Gemini 3.7 Flash 评测登顶,超多款旗舰模型
mtizard · x · 2026-08-20
Google 的 Gemini 3.7 Flash 模型在 Artificial Analysis 的 AA-AnalystAgent 基准测试中取得 60.0% 的成绩,位列第一。
排名情况如下:
- Gemini 3.7 Flash: 60.0%
- Claude Opus 5: 53.8%
- GPT-5.5: 50.0%
- Claude Fable 5: 48.8%
- GPT-5.6 Sol: 47.5%
- Grok 4.6: 41.3%
这一结果表明 Flash 级别的模型性能已超越多款旗舰前沿模型,Google AI 的实力可能被低估。
所属事件:Gemini 3.7 Flash 登顶 AA-AnalystAgent 评测榜首(4 条相关)→
「模型」频道最新
- 评论称 GPT-5.6 Sol 习惯上网搜而非解题 — zainhas · 2026-08-20
- DeepSeek V5 疑似野外测试曝光,Claude Code 推出简洁模式 — WorldofAI · 2026-08-20
- SpaceXAI 换地 69 英亩,斥资 4000 万美元建公共设施 — chrisgrayson · 2026-08-20
- 怀念冷峻版 AI:网友求助绕过日益加严的客套话护栏 — Wargaming123A · 2026-08-20
- Artificial Analysis 新榜:p0 质优价快优势扩大 — jeff_weinstein · 2026-08-20
- Tim Sweeney 称 Sol 5.6 适合难题,Grok 胜在速度 — TimSweeneyEpic · 2026-08-20