Agent Arena 榜单显示 GPT-5.6 Sol 提升 10.1%
arena · x · 2026-07-28
Agent Arena 最新榜单显示,GPT-5.6 Sol 在代理任务上冲到前列,xHigh 档位的净提升达到 +10.1%。
- GPT-5.6 Sol:+10.1%
- GPT-5.6 Terra:+4.0%
- GPT-5.6 Luna:+3.3%
- 三个版本都和 Claude Opus 4.8(+3.5%)处在同一竞争区间
这条信息的重点不是单一模型刷榜,而是 GPT-5.6 的三个变体在代理编排类任务里都拿到了正向提升。
所属事件:Agent Arena 榜单新增 GPT-5.6 系列变体(2 条相关)→
「模型」频道最新
- Kimi K3 许可证保留 MIT 框架又加收入与用户限制 — TheZachMueller · 2026-07-28
- OpenRouter 数据不足全球推理 1%,难证明中文模型已领跑使用量 — zephyr_z9 · 2026-07-28
- GLM-5.2 已能在戴尔工作站本地跑到 40 tokens/s — pcuenq · 2026-07-28
- DesignArena 里出现两个新 GPT 代号:Zinc 和 Magnesium — TheZachMueller · 2026-07-28
- 用户对比 ChatGPT 的克制与 Claude 的强硬风格 — BasedRaddka · 2026-07-28
- Opus 5 被指错误更多,前沿模型增益开始递减 — springrod · 2026-07-28