Claude Opus 5 上线:前沿级表现、每百万输入 5 美元
AI寒武纪 · wechat · 2026-07-25
一篇中文长文快速总结 Claude Opus 5 的官方发布。作者称它面向高频日常使用,整体智能接近更高一档模型,但价格只有后者一半,并且在软件工程、知识工作、电脑操作和生命科学任务上都有明显提升。
主要看点
- 文中提到,Opus 5 在 Frontier-Bench 上领先,和 Opus 4.8 相比能用更低单任务成本把性能拉高到两倍以上;在 CursorBench 3.2 上也几乎追平更高档模型峰值,但成本更低。
- 文章还列举了它在 ARC-AGI 3、Zapier 自动化任务、OSWorld 2.0 电脑操作基准上的表现,强调它在“全新问题解决”和“完整业务任务”上都很强。
- 还写到几个实测案例:自己搭视觉管线重建零件 3D 模型、修复开源项目漏洞、为交易系统构建市场数据验证工具。
API 与提示词建议
- 定价与 Opus 4.8 一致:输入每百万 token 5 美元、输出每百万 token 25 美元。
- 另有 Fast 模式,速度提升 2.5 倍,价格按基础费率的两倍计算。
- API 新增了对话中途切换工具而不失效缓存、以及安全分类器拦截时自动回退到其他可用模型。
- 文章还整理了提示词实践:代码审查时让模型一次性报全问题、视觉任务要配合裁剪和视觉验证工具、小任务要严格限制范围,并控制子智能体调用次数避免成本失控。
作者最后的判断是:Opus 5 已经足够强,可以更放心地投入编码和多步骤 agent 工作流。
所属事件:Anthropic 发布 Claude Opus 5:性能达新 SOTA,价格仅为竞品一半(78 条相关)→
「编程与Agent」频道最新
- Claude 智能体全自动生成周度交易策略报告 — tom_doerr · 2026-07-25
- 一个查历史 agent 会话的提示词每天用五次 — lucasmeijer · 2026-07-25
- Gemini CLI 增加议题分流评测框架与并行判分器 — chadd28 · 2026-07-25
- Claude Opus 5 上线,DirectTerminal 给 Claude Code 补上终端增强输出 — draginol · 2026-07-25
- 开发者吐槽 Claude 写代码强但常误报仓库状态 — brandon_galang · 2026-07-25
- Matt Pocock:没有项目规范,通用代码审查 Agent 很难用 — mattpocockuk · 2026-07-25