GPT-6 系列能力不及 GPT-5.6,首次出现代际升级反而变弱

srchvrs · x · 2026-09-24

Lech Mazur 在 Extended NYT Connections 基准(940 道加入干扰词的 NYT Connections 谜题)上评测发现:Opus 5.5、GPT-6 Sol 和 GPT-6 Luna 都比各自前代略弱但便宜得多。srchvrs 指出,这可能是现代史上首次大版本发布的新模型能力反而低于上一代——此前 GPT-3 到 GPT-4 等每次升级都带来显著能力提升。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →