Anthropic 发布 Claude Opus 5.5:比 Opus 5 便宜 40%,对标 Fable 5.1
addyosmani · x · 2026-09-23
- Anthropic 发布 Claude 5.5 系列首个模型 Claude Opus 5.5,大多数任务上达到 Claude Fable 5.1 水平,运行成本比 Opus 5 低 40%,缓存读取再便宜 60%。
- 性能:早期测试者用它在不到一天内完成 68 万行代码迁移(原本需工程团队数周);在 40 次网页应用加载提速任务中成功 39 次,而 Opus 5 改进更小且破坏了应用行为;单 prompt 游戏构建对比中图形与完成度得分最高。
- 安全:在 Anthropic 的自动化行为审计(对齐测试套件,覆盖数千模拟场景)中取得迄今最强成绩:更少执行难以撤销的操作、更少越界、对 prompt injection 抗性更强于 Opus 5。发布前经 Frontier Design 和 METR 等外部评估者测试,这是 Anthropic 呼吁「前沿放缓」后的首个发布。Addy Osmani 评价其为智能体编码与计算机使用的重大进步。
所属事件:Anthropic 发布 Claude Opus 5.5:更强更快还降价 40%(52 条相关)→
「模型」频道最新
- 用户实测:GPT-6 Sol 与 Luna 已可在 Codex 中使用 — airesearch12 · 2026-09-23
- Matt Shumer 试用 Claude Opus 5.5:感觉像聪明得多的 Opus 4.6 — mattshumer_ · 2026-09-23
- 爆料称 GPT-6 Sol 定价比 GPT-5.6 Sol 便宜 50% — cedric_chee · 2026-09-23
- 曝 OpenAI 开始推送 GPT-6 Sol 与 GPT-6 Luna,覆盖 ChatGPT 和 API — testingcatalog · 2026-09-23
- DiffusionGemma 成 DGX Spark 上的黑马:单机跑「快速 agent」任务 — bodonoghue85 · 2026-09-23
- GPT-6 Sol 与 GPT-6 Luna 双模型上线,OpenAI 官宣在即 — rickasaurus · 2026-09-23