GPT-5.6 在演示任务上领先

ArtificialAnlys · x · 2026-07-10

Artificial Analysis 认为,GPT-5.6 Sol 在 Intelligence vs Output Tokens per Task 指标上定义了新的 Pareto frontier,Terra 和 Luna 没有进入前沿。

在 AA-Briefcase 中,GPT-5.6 Sol(max)仅次于 Claude Fable 5(max),同时拥有所有模型里最高的 Presentation Elo。

所属事件:GPT-5.6系列评测解析:编码登顶且性价比更优(14 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →