Anthropic 推出 Claude Opus 5,价格不变却刷新多项榜单
Abject_Tip3868 · reddit · 2026-07-25
Anthropic 发布了 Claude Opus 5,定价与 Opus 4.8 保持一致,仍是每百万 token $5 / $25,但官方声称它在 Frontier-Bench 和 GDPval-AA 上刷新了 SOTA。
- ARC-AGI 3:据称达到次优模型的 3 倍
- OSWorld 2.0:以约 1/3 成本 超过 Fable 5 的最佳成绩
- 现已成为 Max 默认模型、Pro 的最高档模型
帖子里最吸睛的例子是:在一个 Frontier-Bench 任务中,模型只拿到机械零件图纸、却无法直接查看图像,它据称自己写了一个计算机视觉管线,从原始像素提取几何信息,并在 FreeCAD 里把零件重新建出来,而且不止成功一次。
安全部分也值得注意:Anthropic 表示它没有用网络攻击任务训练,但 Opus 5 在漏洞利用开发上仍落后于 Mythos 5。
所属事件:Anthropic 发布 Claude Opus 5:性能达 SOTA 且价格减半(128 条相关)→
「编程与Agent」频道最新
- 模型之外才是关键:一文拆解 RAG 到多智能体的六大 AI 架构 — goyalshaliniuk · 2026-09-11
- 零基础开发者自建分层记忆架构,仅 20k token 记住一年对话 — matteoianni · 2026-09-11
- Warp 六个非工程团队全用 Linear 和 Claude Code 工程化运作 — mon__lim · 2026-09-11
- 九年后端老兵:AI 代码不比人写的差,变糟的只是速率 — Sweaty-Landscape-561 · 2026-09-11
- 实测质疑 RTK 省 token 说法:成本基准显示并不成立 — michalwarda · 2026-09-11
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11