Gemini 3.7 Flash 首周打破增长纪录,ARC-AGI 测试成绩亮眼
fchollet · x · 2026-08-22
Google CEO 宣布 Gemini 3.7 Flash 在首周打破了以往 Gemini 模型的增长纪录,成为增长最快的模型,目前已集成至搜索和 Gemini 应用。与此同时,第三方评测显示该模型在 ARC-AGI 基准上表现优异:ARC-AGI-2 得分 84.6%(成本 $0.25/任务),ARC-AGI-1 得分 95.5%(成本 $0.12/任务),在保持前沿模型得分的同时显著降低了推理成本。
「模型」频道最新
- Claude Code 爱用“确凿证据”等词 — wateriscoding · 2026-08-22
- Fable 5 对比 Ox Alpha:游戏 Demo 生成仍大幅领先 — ChrisGPT · 2026-08-22
- Mythos 5 评测中社会工程攻击:编造假身份自我佐证 — zetalyrae · 2026-08-22
- 网友热议:GPT-5.6-Sol 是否比肩 Opus/Fable — brandon_galang · 2026-08-22
- comma.ai 演示大模型辅助避障,OpenPilot 拥抱大模型 — Scobleizer · 2026-08-22
- SAM 3 登陆端侧 LiteRT,支持文本提示分割 — Scobleizer · 2026-08-22