Claude Opus 5 领跑代码基准但使用成本偏高
最新代码智能体基准测试显示,Claude Opus 5 在 DeepSWE 等项目中以 67 分位居榜首,但面临 GPT-5.6 sol 的紧追。两者分差仅 1 分,但 Claude Opus 5 的真实使用成本高出约 25%,且 GPT-5.6 sol 的输出 token 数量近乎减半。这表明顶尖 AI 模型在代码能力的激烈角逐中,性价比正成为关键竞争维度。
2026-07-25 ~ 2026-07-26 · 3 条相关
- Claude Opus 5 在代码智能体基准拿到 67 分 — Hesamation · 2026-07-25
- Claude Opus 5 真实使用成本比 GPT-5.6 Sol 高约 25% — thedealdirector · 2026-07-26
- GPT-5.6 sol 只差 Opus 5 一分,输出 token 近乎减半 — haider1 · 2026-07-26