爆料称 GPT-6 Sol 在编码与调试任务上不敌 5.6 Sol

ns123abc · x · 2026-09-23

有用户爆料称(未证实),GPT-6 Sol 在 DeepSWE、computer use 和 research debugging 上确认比 5.6 Sol 更差,在网络安全任务上也没有提升;其优势在于更便宜、更高效,但并不是一个更聪明的模型。

所属事件:GPT-6 Sol/Luna 评测:价格减半幻觉下降,部分基准不敌上代(14 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →