GPT-5.6 sol 只差 Opus 5 一分,输出 token 近乎减半
haider1 · x · 2026-07-26
配图是一个模型基准对比截图:Claude Opus 5 在 DeepSwe 上领先,但 GPT-5.6 sol 只差 1 分,且成本更低、输出 token 也接近少一半。
作者据此认为,OpenAI 已经把模型效率做得很强:在接近顶级成绩的同时,明显压低了成本和 token 消耗。
所属事件:Claude Opus 5 领跑代码基准但使用成本偏高(3 条相关)→
「模型」频道最新
- 对比 Google TPU、Gemini 与 xAI 的 10T 训练说法 — imjustnewatai · 2026-07-26
- Reddit 反馈 GLM-5.2 在 32k 到 64k 上下文后崩溃 — naunen · 2026-07-26
- Meta 和阿姆斯特丹大学改进离散 Flow Matching 生成 — burkov · 2026-07-26
- Model Zen Garden 把盲测做成 3D 模型排行花园 — gajesh · 2026-07-26
- 有人在测 5.6 Sol Pro 的人口伦理提示词是否真有新意 — AaronBergman18 · 2026-07-26
- Claude 额度加购:$100 打 9 折,$250 打 8 折,$1000 没折扣 — HamelHusain · 2026-07-26