Anthropic 发布 Claude Opus 5,多项基准测试领先
Anthropic 于 7 月 25 日正式发布 Claude Opus 5。官方将其定位为更具思考力与主动性的前沿模型,主要面向复杂任务。该模型在多项编程与知识工作评测中达到新的 SOTA,整体智能水平接近 Fable 5,但 token 价格仅为后者的一半。目前新模型已在付费层上线。
已确认
* **模型定位**:Claude Opus 5 被描述为一款更“周到、主动”的思考型模型,面向复杂任务。
* **基准表现**:官方及多位关注者指出,Opus 5 在多数基准上领先,尤其在编码和 agentic 能力方面表现突出,达到新的 SOTA。
* **价格策略**:在接近 Fable 5 前沿智能水平的同时,Opus 5 的 token 价格仅为 Fable 5 的一半(部分早期帖子提及定价与 Opus 4.8 持平)。
* **上线情况**:新模型已在付费层可用。
为什么重要
Opus 5 的发布标志着 Anthropic 在前沿模型市场上采取了更激进的成本策略。通过将顶尖的基准性能与减半的 token 价格结合,该模型直接挑战了竞争对手的定价模式,有望降低开发者和企业在复杂编程与多步智能体任务中的使用门槛。
2026-07-25 ~ 2026-07-25 · 32 条相关
一手来源
- Anthropic 发布 Claude Opus 5:编码更强,对齐更好,价格不变 — ClaudeOfficial ·
- Anthropic 发布 Claude Opus 5,称能力逼近前沿且价格减半 — claudeai ·
- Claude Opus 5 多数基准领先 Fable 5,价格却只有一半 — Yuchenj_UW ·
- Reddit 转发 Anthropic 的 Claude Opus 5 官方发布页 — CucumberAccording813 · 2026-07-25
- 【源头】Anthropic 发布 Claude Opus 5,称能力逼近前沿且价格减半 — claudeai · 2026-07-25
- Anthropic 称 Claude Opus 5 在编码和知识工作评测上已达 SOTA — claudeai · 2026-07-25
- Anthropic 称 Claude Opus 5 以更低任务成本领先对手 — claudeai · 2026-07-25
- Claude Opus 5 在 ARC-AGI-3 评测中得分超次优模型三倍 — claudeai · 2026-07-25
- Anthropic 称 Claude Opus 5 经行为审计后是最对齐的模型 — claudeai · 2026-07-25
- Claude Opus 5 在 ARC-AGI-3 上得分达到第二名的三倍 — claudeai · 2026-07-25
- Anthropic 官宣 Opus 5 定价与安全护栏:主打网络安全场景 — claudeai · 2026-07-25
- 【源头】Anthropic 发布 Claude Opus 5:编码更强,对齐更好,价格不变 — ClaudeOfficial · 2026-07-25
- Anthropic 推出 Claude Opus 5,价格仅为 Fable 5 一半 — thesaraharminta · 2026-07-25
- 基准图表显示 Claude Opus 5 在编程、搜索和生物任务领先 — legit_api · 2026-07-25
- Frontier-Bench 图表对比 Claude Opus 5、Fable 5 和 GPT-5.6 Sol 编程表现 — thesaraharminta · 2026-07-25
- Anthropic 图表显示 Claude Opus 5 多项编程与知识评测领先 — Acceptable-Debt-294 · 2026-07-25
- Opus 5 ARC-AGI-3 达到 30.2%,多项代理基准领先 — socoolandawesome · 2026-07-25
- Anthropic 周五预告指向 Claude Opus 5,价格是 Fable 5 一半 — MeetPatelTech · 2026-07-25
- Anthropic 图表显示 Claude Opus 5 在 ARC-AGI-3 上得分 30.2% — Progressbarist · 2026-07-25
- 【源头】Claude Opus 5 多数基准领先 Fable 5,价格却只有一半 — Yuchenj_UW · 2026-07-25
- Claude 推出 Opus 5,称前沿智能只要半价 — daniel_mac8 · 2026-07-25
- Opus 5 传出 ARC-AGI-3 达到 30.2% — manubfr · 2026-07-25
- Claude Opus 5 在视觉相关基准上表现尤其强 — xeophon · 2026-07-25
- Claude Opus 5 在编码、搜索和推理基准上全面走强 — natolambert · 2026-07-25
- Opus 5 发布,编程搜索和知识工作都进了第一梯队 — Rare_Bunch4348 · 2026-07-25
- Anthropic 用 ARC-AGI-3 测 Opus 5 新推理能力 — typewriters · 2026-07-25
- Opus 5 在 ARC-AGI-3 上约拿到 30% — Dr_Singularity · 2026-07-25
- Anthropic 称 Opus 5 更省 token,也更适合编码任务 — alexalbert__ · 2026-07-25
- ARC-AGI-3 图表显示 Opus 5 领先,但评测成本更高 — Angaisb_ · 2026-07-25
- Anthropic 称 Opus 5 以半价逼近 Fable 5 基准表现 — dotey · 2026-07-25
- Anthropic 发布 Claude Opus 5 旗舰模型 — Over-Necessary-4774 · 2026-07-25
- Claude Opus 5 的 ARC-AGI-3 图表引发一句惊叹 — var_epsilon · 2026-07-25
- Claude Opus 5 在 Frontier-Bench 得分 43.3%,定价仍是 $5/$25 — mark_k · 2026-07-25
- Claude Opus 5 在 SWE-bench Verified 拿到 96.0% — connoraxiotes · 2026-07-25
- FrontierCode 显示 Claude Opus 5 在中等推理强度达到峰值 — philhchen · 2026-07-25