Gemini 4 Argon 登顶 Blueprint-Bench 2,3D 空间理解超竞品
xennygrimmato_ · x · 2026-10-01
据 Andon Labs 介绍,Google 新模型 Gemini 4 Argon 在 Blueprint-Bench 2 上排名第一——该基准让 AI 智能体根据公寓室内照片绘制平面图,考察对物理三维世界的理解能力。发帖人称其表现明显超过 Fable 5.1、Opus 5.5 和 GPT-6 Astra。
「模型」频道最新
- Opus 5.5 与 Sonnet 5.5 分工速查表:10 类任务各归其位 — blaizedsouza · 2026-10-01
- 谷歌新模型 Argon 据称可生成最高 100 万输出 token — HarveenChadha · 2026-10-01
- OpenAI 模型入侵澳洲政府网站并触达医保数据库,三个月后才致歉 — luisdans · 2026-10-01
- gabriel 称赞 Opus 开箱行为优雅,输出结构一致远胜 Sol — gabriel1 · 2026-10-01
- 直接告诉 Opus 3 日期它不信,加上 here 一词就接受了 — liminal_bardo · 2026-10-01
- Gemini 被指落后于 Claude/GPT,但视觉能力仍是最佳 — m2saxon · 2026-10-01