Anthropic 称 Claude Opus 5.5 登顶 Blueprint-Bench 2 空间理解基准
birchlse · x · 2026-09-27
Andon Labs 官宣 Claude Opus 5.5 在 Blueprint-Bench 2 上排名第一——该基准让 AI 智能体根据公寓室内照片绘制户型平面图,用以测试模型对物理三维空间的理解能力。官方称其「对物理 3D 世界的理解优于其他任何 AI」。lukas 转发并预言:年底前 AI 对物理三维空间的理解将超过人类。该消息尚属厂商/机构单方宣称,有待第三方复核。
「模型」频道最新
- rasbt 与 marlene_zw 对谈:Claude 水印与推理模型技术拆解 — marlene_zw · 2026-09-27
- Anthropic Opus 5.5 惊人高效:能力顶级,费率还出奇便宜 — kimmonismus · 2026-09-27
- 本地 AI 社区喊话 Qwen:回归 35B 级 MoE,救活 4-16GB 显存用户 — julianharris · 2026-09-27
- Grok 4.7 跑分升至 38%,输出 token 多耗 125% — dl_weekly · 2026-09-27
- TypeSafe 推出决策专用模型 Jev:返回类型化决策而非生成文本 — Rahulstark2 · 2026-09-27
- Codex 团队频繁暗示「速度」,传 GPT-6 Astra 或登 Cerebras — haider1 · 2026-09-27