Claude Opus 5 发布并重写提示习惯
Anthropic 于 2026 年 7 月 24 日发布 Claude Opus 5。按 @AlexKim 基于迁移指南的整理,它的 API 定价并未下调,仍是输入 $5 / 百万 token、输出 $25 / 百万 token,但编程能力已被描述为与 Fable 5 只差约 0.5 分。更值得关注的是行为模式变化:Opus 5 会在未被要求时自行核查答案,这可能让不少沿用多年的提示词和验证流程失效。
已确认
- @AlexKim 称 Opus 5 价格与 Opus 4.8 一致,为输入 $5 / 百万 token、输出 $25 / 百万 token。
- 多条帖子将其概括为接近“Fable-class intelligence”;@AlexKim 进一步称其编程能力与 Fable 5 的差距约为 0.5 分。
- @aidenybai 认为它是 Claude 系列在 ReactBench 上表现最强的模型,并强调其前端代码性价比。
- @majidmanzarpour 转述 Anthropic 提示指南称,Opus 5 最适合复杂的 agent 编程任务与代码审查,提示方式也应更收敛。
- @AlexKim 提到 Opus 5 现支持完整五档 effort,且低档位表现也相对稳定。
- API 侧还有几项迁移注意事项:在 4.8 上不传参仍会默认开启 thinking;在 Opus 5 中若关闭 thinking 又设置 xhigh 或 max effort,会直接返回 400;maxtokens 现在同时限制 thinking token 与输出 token。
- @AlexKim 还指出,Opus 5 会自行核查答案,因此过去常见的“回答前再检查一遍”类提示词可能会让模型重复劳动;相应地,旧的 harness 级 verification pass 也可能变得成本大于收益。
尚未确认
- @heypearlai 及 @GregCook2011 转发内容都称 Opus 5 价格约为 Opus 4.8 的一半,但这与 @AlexKim 基于迁移指南给出的定价信息相冲突,且材料中无更多佐证。
- @heypearlai 还称 Opus 5 已成为 Claude Max 的新默认模型,但本组帖子未提供直接的一手确认。
为什么重要
Opus 5 的意义不只是在编码能力上进一步逼近 Fable 5,更在于它似乎没有伴随已确认的 API 涨价。对开发者来说,真正的变化是工作流层面:提示词工程、验证链路和 token 预算规则,都可能因为模型自检能力增强而需要重写。
2026-07-27 ~ 2026-07-28 · 11 条相关
- 第 1 集:Anthropic 模型发布陷混乱,Opus 5 被指关乎成败(2026-07-23,2 条)
- 第 2 集:Anthropic 发布 Claude Opus 5:性能达 SOTA 且价格减半(2026-07-25,128 条)
- 第 3 集:网传 Anthropic 发布 Opus 5,支持加速与科研顶配(2026-07-25,3 条)
- 第 4 集:Claude Opus 5 早期实测:效率提升但行为过度主动(2026-07-25,29 条)
- 第 5 集:Anthropic发布Claude Opus 5实测表现亮眼(2026-07-25,3 条)
- 第 6 集:Claude Opus 5 被指刷榜优化,实测仍落后(2026-07-25,2 条)
- 第 7 集:Claude Opus 5 创下 ARC-AGI-3 新纪录(2026-07-25,15 条)
- 第 8 集:Anthropic 内部材料曝光 Opus 5 研发进展(2026-07-25,2 条)
- 第 9 集:Opus 5 实测:单 prompt 生成惊艳,复杂任务仍逊 Fable(2026-07-26,24 条)
- 第 10 集:Claude Opus 5 发布并重写提示习惯(2026-07-27,11 条)
- 第 11 集:Anthropic Opus 5 基准领先但实战口碑分裂(2026-07-28,6 条)
- 第 12 集:Claude Opus 系列被指体验下滑:偷懒失忆引信任危机(2026-07-29,14 条)
- 第 13 集:Anthropic 发布 Claude Opus 5:性能比肩旗舰且成本减半(2026-07-31,2 条)
- 第 14 集:Anthropic 新版模型体验下滑引发开发者信任危机(2026-08-03,11 条)
一手来源
- Claude Opus 5 维持 4.8 版定价,编码表现逼近 Fable 5 — AlexKim ·
- Anthropic Opus 5 会自行核查答案,旧式双重检查提示词已多余 — AlexKim ·
- Anthropic 称 Opus 5 最适合复杂编程 Agent 和代码审查 — majidmanzarpour ·
- Claude Opus 5 据称价格减半并刷榜 Frontier-Bench — GregCook2011 · 2026-07-27
- Anthropic 推出 Claude Opus 5,价格只有旧档位一半 — heypearlai · 2026-07-27
- Anthropic 的 Opus 5 被称在 ReactBench 上更强且便宜 2 倍多 — aidenybai · 2026-07-28
- Claude Opus 5 迁移指南悄悄改写了多年提示词建议 — AlexKim · 2026-07-28
- 【源头】Anthropic Opus 5 会自行核查答案,旧式双重检查提示词已多余 — AlexKim · 2026-07-28
- Anthropic 认为旧的 harness 验证层可能已经多余 — AlexKim · 2026-07-28
- Anthropic Opus 5 在关闭 thinking + 高 effort 时会报错 — AlexKim · 2026-07-28
- Claude Opus 5 价格不变,在编程上逼近 Fable 5 — AlexKim · 2026-07-28
- 【源头】Claude Opus 5 维持 4.8 版定价,编码表现逼近 Fable 5 — AlexKim · 2026-07-28
- Anthropic Opus 5 支持五档 effort,4.8 还会默认开启 thinking — AlexKim · 2026-07-28
- 【源头】Anthropic 称 Opus 5 最适合复杂编程 Agent 和代码审查 — majidmanzarpour · 2026-07-28