Anthropic发布Claude Opus 5实测表现亮眼
Anthropic发布了Claude Opus 5模型。实测表明,该模型在编码、推理、智能体和物理模拟等场景下能力显著提升,且价格保持不变。尽管有测试者吐槽其交互风格有些“神经质”且安全限制收缩,但在盲测排名中,Claude Opus 5依然超越了GPT-5.6等模型,位居所有模型之首。
2026-07-25 ~ 2026-07-25 · 3 条相关
- 第 1 集:Anthropic 模型发布陷混乱,Opus 5 被指关乎成败(2026-07-23,2 条)
- 第 2 集:Anthropic 发布 Claude Opus 5:性能达 SOTA 且价格减半(2026-07-25,128 条)
- 第 3 集:网传 Anthropic 发布 Opus 5,支持加速与科研顶配(2026-07-25,3 条)
- 第 4 集:Claude Opus 5 早期实测:效率提升但行为过度主动(2026-07-25,29 条)
- 第 5 集:Anthropic发布Claude Opus 5实测表现亮眼(2026-07-25,3 条)
- 第 6 集:Claude Opus 5 被指刷榜优化,实测仍落后(2026-07-25,2 条)
- 第 7 集:Claude Opus 5 创下 ARC-AGI-3 新纪录(2026-07-25,15 条)
- 第 8 集:Anthropic 内部材料曝光 Opus 5 研发进展(2026-07-25,2 条)
- 第 9 集:Opus 5 实测:单 prompt 生成惊艳,复杂任务仍逊 Fable(2026-07-26,24 条)
- 第 10 集:Claude Opus 5 发布并重写提示习惯(2026-07-27,11 条)
- 第 11 集:Anthropic Opus 5 基准领先但实战口碑分裂(2026-07-28,6 条)
- 第 12 集:Claude Opus 系列被指体验下滑:偷懒失忆引信任危机(2026-07-29,14 条)
- 第 13 集:Anthropic 发布 Claude Opus 5:性能比肩旗舰且成本减半(2026-07-31,2 条)
- 第 14 集:Anthropic 新版模型体验下滑引发开发者信任危机(2026-08-03,11 条)
- Anthropic 发布 Claude Opus 5,盲测排名超过 GPT-5.6 — lennysan · 2026-07-25
- Claude Opus 5 首测指向更强编程能力且价格不变 — Prompt Engineering · 2026-07-25
- Claude Opus 5 实测覆盖编码、智能体和物理模拟 — WorldofAI · 2026-07-25