Anthropic 发布 Claude Opus 5:编程与推理登顶,安全护栏拦截率大降 85%
机器之心 · wechat · 2026-07-25
Anthropic 正式发布新一代模型 Claude Opus 5。该模型在保持与前代相同定价(输入 5 美元/输出 25 美元/百万 token)的前提下大幅提升性能,成本仅为 Fable 5 的一半,并新增了 2.5 倍速的「极速模式」。
- 评测表现:在 Frontier-Bench 等编程与智能体评测中刷新纪录,ARC-AGI 3 得分达第二名三倍。在 OSWorld 2.0 等基准的同等成本下表现领先。
- 自主与科研能力:展现出极强的自我纠错与工程闭环能力(如自行编写 CV 流水线重建 3D 零件、自建测试框架验证代码)。在生命科学(有机化学、蛋白功能预测)等方向显著进步。
- 安全与对齐:被称为迄今对齐程度最高的模型。网络安全分类器大幅放宽,允许查找源码漏洞,拦截率预计较 Fable 5下降 85%。被拦截请求可自动回退至 Opus 4.8 处理。
所属事件:Anthropic 发布 Claude Opus 5:性能达新 SOTA 且价格减半(90 条相关)→
「编程与Agent」频道最新
- Claude Code 2.1.220 即将发布 — ClaudeCodeLog · 2026-07-25
- Fable 帮人给 Opus 5 画出 latent space game — repligate · 2026-07-25
- Seroter 读书清单聚焦智能体规格、AI 回报与脆弱架构 — rseroter · 2026-07-25
- LM Studio 推出 Bionic:面向文档、编程和语音的本地智能体 — nicolascraske · 2026-07-25
- 《Clean Code》作者反驳:真正的工程比 Vibe Coding 更严谨 — burny_tech · 2026-07-25
- AI 安全智能体实战:成功挖掘 GitLab 默认配置 RCE 漏洞 — andreamichi · 2026-07-25