Claude Opus 5 首测指向更强编程能力且价格不变
Prompt Engineering · youtube · 2026-07-25
Claude Opus 5 首次上手:编程更强,价格不变,安全能力收缩
这条视频对 Anthropic 新发布的 Claude Opus 5 做了快速实测,并拿它和 “Fable 5” 做了多项第三方基准对比,包括 Cursor 和 Devin/Frontier Code。作者认为,Opus 5 在 agentic coding 上表现很强,整体能力看起来接近“更便宜约一半”的升级。
- 视频里提到,定价与 Opus 4.8 相同。
- Anthropic 似乎 有意降低了网络安全/攻防相关能力。
- 实测覆盖 claude.ai 和 Claude Code,并强调其 1M 上下文 能力。
- 演示案例包括:一个 宝可梦百科网站、一个能组成 “Hello World, I’m Opus” 的人群动画(还加了镜头控制)、以及一个生成耗时较长但细节丰富的 ISS 追踪器。
- 作者还指出了某张基准图表里的可疑细节,并表示后续会做更深入的评测。
所属事件:Claude Opus 5 实测:编程增强且价格不变(2 条相关)→
「模型」频道最新
- 梗图把 OpenAI、Anthropic、DeepSeek、Qwen 画成同一句口号循环 — haider1 · 2026-07-25
- 一则长线程称,回形针末日论属于前 LLM 时代想象 — repligate · 2026-07-25
- Anthropic 评测图显示 Claude Opus 5 约 163.5 分 — scaling01 · 2026-07-25
- Grok 4.5 下调缓存读价格,单任务成本降 25% — Baconbrix · 2026-07-25
- Reddit 称 Claude Opus 5 在 3D 破坏测试中胜过 Fable 5 — Successful-Earth678 · 2026-07-25
- 模型评测越来越难:该奖最小修复还是最佳重构 — hichaelmart · 2026-07-25