Anthropic 发布 Claude Opus 5.5:性能追平 Fable 5.1,成本低 40%
aigclink · x · 2026-09-23
Anthropic 宣布推出 Claude 5.5 家族首款模型 Claude Opus 5.5,定位为其新旗舰。
要点:
- 性能:在多数任务上达到 Claude Fable 5.1 水平,运行成本比 Opus 5 低 40%;有测试者用它不到一天完成 68 万行代码迁移(原需工程团队数周)。
- 实测:在一个 Web 应用全页加载时间优化任务中 40 次成功 39 次,且不改变应用行为;单 prompt 建游戏的图形与完成度优于其他 Claude 模型。
- 安全:在自动化行为审计(对齐测试套件)中取得迄今最强成绩,更少采取难以回退的动作、更 resistant 于 prompt injection;发布前经 Frontier Design、METR 等外部评估者测试,并扩展了对齐测试覆盖更长任务与真实事故场景。
所属事件:Anthropic 发布 Claude Opus 5.5:更便宜 40% 更快 30%(68 条相关)→
「模型」频道最新
- Pokédex 视觉横评:同一 Prompt 实测多款 AI 编码模型 — kevinkern · 2026-09-23
- 三元权重压缩 27B 模型仅 5.9GB,推理能力保留 95% — cephaloform · 2026-09-23
- 小米 MiMo-V2.6 公开 RL 训练:DeepSWE 从 58.4 冲至 72.57 — teortaxesTex · 2026-09-23
- steipete 调侃 Anthropic harness 封禁:只封流行的那些 — steipete · 2026-09-23
- Gemini 训练细节曝光:组级奖励重分配对抗 reward hacking — nrehiew_ · 2026-09-23
- 同一像素动画编程题横评:仅一个模型全程无干预跑通 — hullabaloo22 · 2026-09-23