传 GPT-6 Sol 在 DeepSWE 等基准反而逊于 5.6 Sol:被讽只是改名 Terra

kristoph · x · 2026-09-23

有爆料称 GPT-6 Sol 在 DeepSWE、computer use 和 research debugging 上表现比 5.6 Sol 更差,在 cyber 能力上也没有提升——更便宜更高效,但不是更聪明的模型(未证实)。Kristoph 评论讽刺道:他们基本上就是把 Terra 改了个名而已。

所属事件:GPT-6 Sol/Luna 评测出炉:更便宜更少幻觉,但部分基准不敌前代(16 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →