GPT-5.6 Sol 领跑编码评测

thesaraharminta · x · 2026-07-10

转述称 GPT-5.6 Sol(max)在 Artificial Analysis Coding Agent Index 中领先所有评测,并在 SWE-Atlas-QnA 的 Grok Build 上与 Grok 4.5 持平。

同时,它的单任务成本低于 Claude Fable 5(max)和 Claude Opus 4.8(max),体现了编码 agent 场景下的性能/成本优势。

所属事件:OpenAI 发布 GPT-5.6 系列:主打多智能体与极致性价比(119 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →