Anthropic 发布 Opus 5.5:定价降 40% 至 $4/$20,Terminal-Bench 得 66.4%
dl_weekly · x · 2026-09-26
Anthropic 发布 Claude 5.5 家族首个模型 Claude Opus 5.5:价格降至 $4/$20 每百万 token,比 Opus 5 便宜 40%,输出速度提升超 30%,在 Terminal-Bench 4.0 得 66.4%。官方称其整体达到 Claude Fable 5.1 水平,并经 Frontier Design 与 METR 等外部评估者发布前测试,在自动化行为审计(对齐测试)中是迄今表现最强的模型,更少采取难以撤销的操作、抗 prompt injection 能力强于 Opus 5。示例:一位测试者用它在不到一天内完成 68 万行代码迁移(原需工程团队数周);在为整个 Web 应用加速的任务中 40 次成功 39 次,而 Opus 5 改进更小且会改变应用行为。
所属事件:Claude Opus 5.5 发布:性能对标上代,成本降 40%(2 条相关)→
「模型」频道最新
- 开发者惊叹:Opus 5.5 做游戏的能力出乎意料地强 — tobowers · 2026-09-27
- 167 个模型上创意写作基准,作者开帖 AMA 谈性能与成本 — OnlyProggingForFun · 2026-09-27
- 周报:Amazon 封禁 Muse、agent 抢订餐厅,Opus 与 GPT 掀 90 分钟价格战 — njyx · 2026-09-27
- 评测设计细节:让模型自选风格参考并在独立调用中完成 — maxsloef · 2026-09-27
- Namedrop 评测:模型给具名风格参考效果远胜形容词组 — maxsloef · 2026-09-27
- Lei.Chat 上线 DeepSeek V4、GLM 5.3、Kimi K3 交互式架构图鉴 — zhyncs42 · 2026-09-27