Claude Opus 5.5 发布:Terminal-Bench 66.4% 超越 Fable 5.1,价格降 60%
xiaohu · x · 2026-09-23
Anthropic 发布 Claude Opus 5.5,编程、视觉与写作能力大幅升级,价格显著下调。
关键数据
- Terminal-Bench 得分 66.4%(Fable 5.1 为 55.8%);CursorBench 57.8% 对 51.8%
- API 定价:输入 4 美元/百万 Token、输出 20 美元,比 Fable 5.1(10/50 美元)低 60%;较上代 Opus 5 典型任务费用约低 40%,输出速度快 30% 以上
能力变化
- 编程:更适合连续推进跨文件修改和长时间工程任务,中间不再需要反复确认
- 视觉与交互:能生成水下探索游戏、手绘动画、可调投石机等完整作品
- 知识工作:财报查证、并购建模等测试达 1846 Elo(Fable 5.1 为 1735)
- 写作:重要信息前置、少套话、更愿遵守用户表达规则。官方账单排错示例中,新版先交代金额影响(1.50 美元来自免费层调整、9.92 美元来自月末最后一天漏计费的 Bug),再讲代码问题
作者提醒:面对更能持续执行的 Opus 5.5,过去切小步、反复问"继续吗"的习惯反而可能切断本可连贯完成的工作。
所属事件:Anthropic 发布 Claude Opus 5.5:更强更便宜,登顶智能指数榜(187 条相关)→
「编程与Agent」频道最新
- 资深工程师:AI 吃不掉 SWE 岗位,吃掉的是不会解边界问题的人 — kmeanskaran · 2026-09-23
- 他设想把 ChatGPT/Codex 变成可视化插件开发环境 — Former_Worldliness70 · 2026-09-23
- boxd_sh 被赞 agent 持久云电脑利器:计费、时序与开发者体验俱佳 — tobowers · 2026-09-23
- 开源 AI 印度股票日内交易机器人:每 15 秒给 Nifty 50 排序下单 — IndraVahan · 2026-09-23
- Planner 复现不了坏计划:Agent 平台调试到底该存什么状态 — fishyguy3123 · 2026-09-23
- Yoav Goldberg:部分任务可用正则等确定性规则,agent 能帮忙写 — yoavgo · 2026-09-23