GPT 5.6 Sol 编程成本大降,同等性能花费减半
jyangballin · x · 2026-08-11
在 ProgramBench 测试中,尽管 GPT 5.6 Sol 在测试通过率上的绝对分数相比 5.5 提升有限,但其效率显著提高。在达到相同性能指标的情况下,GPT 5.6 Sol 的花费仅为 6.08 美元(前代为 8.85 美元),且交互轮次从 82 轮大幅缩减至 42 轮。
所属事件:GPT 5.6 Sol 登顶 ProgramBench,重构成本减半但偏科 Python(6 条相关)→
「模型」频道最新
- 未发布版Claude挑战黎曼猜想,突破性提升数学下界 — haider1 · 2026-08-11
- 实测反直觉:参数翻倍的 Gemma 31B 提取数据反逊 Ministral 14B — andrejusb · 2026-08-11
- Muse Glimmer 30B 本地实测:精准定位医疗表单复选框 — MaziyarPanahi · 2026-08-11
- OpenAI 推出 GPT-5.6-Cyber 模型,专攻网络安全防御 — The Decoder · 2026-08-11
- Muse Glimmer 陷入终端指令死循环,消耗大量 Token — KingGongzilla · 2026-08-11
- Muse Spark 1.2 模型权重即将开源发布 — shuyanzh36 · 2026-08-11