降价后差距拉大:GPT-5.6 Sol Max 每 task 仅 6.47 美元胜 Fable
reach_vb · x · 2026-08-25
在 DeepSWE v1.1 编码智能体基准(113 项原始长程工程任务)上,GPT-5.6 Sol Max 本来就是更划算的选择,近期降价后优势进一步扩大:Sol 得分 72.7%、每任务成本 6.47 美元;Fable 5 Max 得分 69.7%、每任务成本 21.63 美元。
「模型」频道最新
- Grok 自发生成图片推送,被指游击式用户促活 — StefanoGogioso · 2026-08-25
- 安全研究员吐槽:申请 Claude 网络安全权限一个多月无回音 — nptacek · 2026-08-25
- Codex 溢出额度骤减,漏洞利用价值远高于公开赏金 — nptacek · 2026-08-25
- 开发者吐槽 Ox Alpha 推理缓慢:10 分钟任务耗时 127 分钟 — altryne · 2026-08-25
- a16z 合伙人体验未发布模型称极其震撼 — AccBalanced · 2026-08-25
- 中 LLM 仍落后美 4-5 月,ECI 155 或为可用门槛 — Jsevillamol · 2026-08-25