Anthropic 发布 Claude Opus 5:性能达 SOTA 且价格减半
7 月 25 日,Anthropic 正式发布前沿模型 Claude Opus 5。官方将其定位为一款更具思考力与主动性的模型,主要面向复杂任务。该模型在编码、推理等多项基准测试中达到新的 SOTA,整体智能水平接近 Fable 5,但 token 价格仅为后者的一半。目前新模型已确认在付费层及 Box 平台上线。
已确认
- 模型定位与价格:Claude Opus 5 被官方定义为一款更“周到、主动”的思考型模型。在定价策略上,其 token 价格与 Opus 4.8 持平,约为 Fable 5 价格的一半。不过,@bindureddy 指出其在相似任务上的实际花费可能比 4.8 贵约 15%,但整体仍算严格升级。@alexalbert 补充称,团队优化了跨领域 token 效率,使其在使用时更省 token。
- 基准表现(SOTA):官方及多位关注者提供的图表显示,Opus 5 在多数基准上取得领先。具体数据包括:终端编码达到 43.3%,ARC-AGI-3 得分 30.2%(据称为次优模型的三倍),并在 SimpleBench 上排到第二名(仅落后 Fable 1%、落后人类 3%)。对比对象涵盖 Fable 5、Opus 4.8 和 GPT-5.6 Sol。
- 安全与对齐:@Polymarket 转述 Anthropic 的说法,称 Opus 5 是其目前“最对齐”的模型,观察到的鲁莽或欺骗行为率最低。
- 上线情况:新模型已确认在付费层可用,@Matthew Berman 提到该模型也已上线 Box 平台。
为什么重要
Opus 5 的发布直接挑战了竞争对手的定价模式。通过将顶尖的基准性能(特别是在编码和多步智能体任务上)与减半的竞品 token 价格结合,Anthropic 有望大幅降低开发者与企业使用复杂 AI 模型的门槛,进一步加剧前沿大模型市场的竞争。
2026-07-25 ~ 2026-07-26 · 128 条相关
- 第 1 集:Anthropic 模型发布陷混乱,Opus 5 被指关乎成败(2026-07-23,2 条)
- 第 2 集:Anthropic 发布 Claude Opus 5:性能达 SOTA 且价格减半(2026-07-25,128 条)
- 第 3 集:网传 Anthropic 发布 Opus 5,支持加速与科研顶配(2026-07-25,3 条)
- 第 4 集:Claude Opus 5 早期实测:效率提升但行为过度主动(2026-07-25,29 条)
- 第 5 集:Anthropic发布Claude Opus 5实测表现亮眼(2026-07-25,3 条)
- 第 6 集:Claude Opus 5 被指刷榜优化,实测仍落后(2026-07-25,2 条)
- 第 7 集:Claude Opus 5 创下 ARC-AGI-3 新纪录(2026-07-25,15 条)
- 第 8 集:Anthropic 内部材料曝光 Opus 5 研发进展(2026-07-25,2 条)
- 第 9 集:Opus 5 实测:单 prompt 生成惊艳,复杂任务仍逊 Fable(2026-07-26,24 条)
- 第 10 集:Claude Opus 5 发布并重写提示习惯(2026-07-27,11 条)
- 第 11 集:Anthropic Opus 5 基准领先但实战口碑分裂(2026-07-28,6 条)
- 第 12 集:Claude Opus 系列被指体验下滑:偷懒失忆引信任危机(2026-07-29,14 条)
- 第 13 集:Anthropic 发布 Claude Opus 5:性能比肩旗舰且成本减半(2026-07-31,2 条)
- 第 14 集:Anthropic 新版模型体验下滑引发开发者信任危机(2026-08-03,11 条)
一手来源
- Anthropic 发布 Claude Opus 5,称能力逼近前沿且价格减半 — claudeai ·
- Anthropic 发布 Claude Opus 5:编码更强,对齐更好,价格不变 — ClaudeOfficial ·
- Claude Opus 5 上线 Box,Anthropic 前沿模型再更新 — Matthew Berman ·
- Reddit 转发 Anthropic 的 Claude Opus 5 官方发布页 — CucumberAccording813 · 2026-07-25
- 【源头】Anthropic 发布 Claude Opus 5,称能力逼近前沿且价格减半 — claudeai · 2026-07-25
- Anthropic 称 Claude Opus 5 在编码和知识工作评测上已达 SOTA — claudeai · 2026-07-25
- Anthropic 称 Claude Opus 5 以更低任务成本领先对手 — claudeai · 2026-07-25
- Claude Opus 5 在 ARC-AGI-3 评测中得分超次优模型三倍 — claudeai · 2026-07-25
- Anthropic 称 Claude Opus 5 经行为审计后是最对齐的模型 — claudeai · 2026-07-25
- Claude Opus 5 在 ARC-AGI-3 上得分达到第二名的三倍 — claudeai · 2026-07-25
- Anthropic 官宣 Opus 5 定价与安全护栏:主打网络安全场景 — claudeai · 2026-07-25
- 【源头】Anthropic 发布 Claude Opus 5:编码更强,对齐更好,价格不变 — ClaudeOfficial · 2026-07-25
- Anthropic 推出 Claude Opus 5,价格仅为 Fable 5 一半 — thesaraharminta · 2026-07-25
- 基准图表显示 Claude Opus 5 在编程、搜索和生物任务领先 — legit_api · 2026-07-25
- Frontier-Bench 图表对比 Claude Opus 5、Fable 5 和 GPT-5.6 Sol 编程表现 — thesaraharminta · 2026-07-25
- Anthropic 图表显示 Claude Opus 5 多项编程与知识评测领先 — Acceptable-Debt-294 · 2026-07-25
- Anthropic 周五预告指向 Claude Opus 5,价格是 Fable 5 一半 — MeetPatelTech · 2026-07-25
- Anthropic 发布 Claude Opus 5 系统卡 — tokenbender · 2026-07-25
- Anthropic 图表显示 Claude Opus 5 在 ARC-AGI-3 上得分 30.2% — Progressbarist · 2026-07-25
- Claude Opus 5 多数基准领先 Fable 5,价格却只有一半 — Yuchenj_UW · 2026-07-25
- Opus 5 发布,agentic 编码、搜索和电脑操作成绩强势 — TheInfiniteUniverse_ · 2026-07-25
- Claude 推出 Opus 5,称前沿智能只要半价 — daniel_mac8 · 2026-07-25
- Opus 5 传出 ARC-AGI-3 达到 30.2% — manubfr · 2026-07-25
- Claude Opus 5 在视觉相关基准上表现尤其强 — xeophon · 2026-07-25
- Anthropic 放出 Claude Opus 5 system card,内部评测多项领先 Mythos 5 — tokenbender · 2026-07-25
- Claude Opus 5 在编码、搜索和推理基准上全面走强 — natolambert · 2026-07-25
- Claude Opus 5 在 ARC-AGI-3 拿到 30.2% — mahamara · 2026-07-25
- Claude Opus 5 登陆 Cursor,基准分数追平 Fable 5 且价格减半 — dean_rie · 2026-07-25
- 曝 Claude Opus 5 系统卡片发布,网络安全能力大幅提升 — tokenbender · 2026-07-25
- Anthropic 用 ARC-AGI-3 测 Opus 5 新推理能力 — typewriters · 2026-07-25
- Claude Opus 5 公布终端编码 43.3% 和 ARC-AGI-3 30.2% — Additional_Bowl_7695 · 2026-07-25
- Anthropic 称 Opus 5 更省 token,也更适合编码任务 — alexalbert__ · 2026-07-25
- Opus 5 比 4.8 明显更强,但“灵光”仍不如 Fable 5 — bindureddy · 2026-07-25
- ARC-AGI-3 图表显示 Opus 5 领先,但评测成本更高 — Angaisb_ · 2026-07-25
- Opus 5 价格涨约 15%,但仍被视为 4.8 的严格升级 — bindureddy · 2026-07-25
- Anthropic 称 Opus 5 以半价逼近 Fable 5 基准表现 — dotey · 2026-07-25
- Anthropic 发布 Claude Opus 5 旗舰模型 — Over-Necessary-4774 · 2026-07-25
- Anthropic 推出 Claude Opus 5,价格不变却刷新多项榜单 — Abject_Tip3868 · 2026-07-25
- Anthropic 传出 Claude Opus 5 定价不变且基准大涨 — 歸藏的AI工具箱 · 2026-07-25
- Claude Opus 5 的 ARC-AGI-3 图表引发一句惊叹 — var_epsilon · 2026-07-25
- Claude Opus 5 在 Frontier-Bench 得分 43.3%,定价仍是 $5/$25 — mark_k · 2026-07-25
- Anthropic 称 Claude Opus 5 刻意避开网络安全任务训练 — rez0__ · 2026-07-25
- Anthropic 的 Opus 5 似乎更像一次大升级 — yi_ding · 2026-07-25
- Anthropic 称 Opus 5 漏洞发现更强,但仍落后 Mythos 5 — TheZvi · 2026-07-25
- 一张 benchmark 图把 Claude Opus 5 又变成 AI 口水战梗 — daluoseo · 2026-07-25
- Claude Opus 5 在 SWE-bench Verified 拿到 96.0% — connoraxiotes · 2026-07-25
- FrontierCode 显示 Claude Opus 5 在中等推理强度达到峰值 — philhchen · 2026-07-25
- Opus 5 多项基准领跑,覆盖编程搜索与推理 — signulll · 2026-07-25
- Claude Opus 5 与 5 Fast 上线,主打长任务执行 — matanSF · 2026-07-25
- Opus 5 据称在 SimpleBench 上排第二,只差 Fable 1% — Calm_Hedgehog8296 · 2026-07-25
另有 3 条近重复转述:Rare_Bunch4348 · Dr_Singularity · Byakko_4