博主实测:GPT-6-Sol xhigh 在 Codex 的 Boeing bench 表现平平

victormustar · x · 2026-09-23

博主 @victormustar 发帖称,在 Codex 中使用 GPT-6-Sol xhigh 模型跑 Boeing bench 成绩并不理想("not great")。帖内未附具体分数,仅给出截图链接,需以原图数据为准;这是一条对最新模型编码能力的早期负面反馈,可作为后续评测对比的线索。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →