Claude Opus 5 首测指向更强编程能力且价格不变
Prompt Engineering · youtube · 2026-07-25
Claude Opus 5 首次上手:编程更强,价格不变,安全能力收缩
这条视频对 Anthropic 新发布的 Claude Opus 5 做了快速实测,并拿它和 “Fable 5” 做了多项第三方基准对比,包括 Cursor 和 Devin/Frontier Code。作者认为,Opus 5 在 agentic coding 上表现很强,整体能力看起来接近“更便宜约一半”的升级。
- 视频里提到,定价与 Opus 4.8 相同。
- Anthropic 似乎 有意降低了网络安全/攻防相关能力。
- 实测覆盖 claude.ai 和 Claude Code,并强调其 1M 上下文 能力。
- 演示案例包括:一个 宝可梦百科网站、一个能组成 “Hello World, I’m Opus” 的人群动画(还加了镜头控制)、以及一个生成耗时较长但细节丰富的 ISS 追踪器。
- 作者还指出了某张基准图表里的可疑细节,并表示后续会做更深入的评测。
所属事件:Anthropic发布Claude Opus 5实测表现亮眼(3 条相关)→
「模型」频道最新
- 有人要建全模型基准分数汇总页 — airesearch12 · 2026-09-11
- 爆料称 Kimi 疑似转发 Claude 冒充自家成绩,DeepSeek 新模型评测反超 — realsohamparekh · 2026-09-11
- 网友吐槽 GPT-5.6 文笔好读但缺乏记忆点 — BasedRaddka · 2026-09-11
- Opus 以"安全"为由拒碰蛋白质生成代码,开发者吐槽误伤 — josephdviviano · 2026-09-11
- 网友称 DeepSeek 4.1 Flash 是语言模型历史拐点(未证实) — himanshustwts · 2026-09-11
- Terminal Bench v4 榜单:GLM-5.3 以 41.9% 一骑绝尘 — Ok_Warning2146 · 2026-09-11