Anthropic 发布 Claude Opus 5.5:性能持平旗舰,成本降 40%
sven_ai · x · 2026-09-28
Anthropic 发布新家族首个模型 Claude Opus 5.5,多数任务表现与 Claude Fable 5.1 持平,运行成本比 Opus 5 低 40%,这也是其呼吁前沿放缓后的首个发布,经 Frontier Design 和 METR 外部评测。
- 性能:早期测试者用它在一天内完成 68 万行代码迁移(原需工程团队数周);优化 Web 应用加载时间的任务 40 次成功 39 次;单 prompt 建游戏测试中图形与完成度得分超所有其他模型。
- 安全:自动行为审计得分为其测试过的最强模型,更少越界与不可逆操作,对 prompt injection 抵抗力强于 Opus 5。
- 中文博主强调其对「长跨度推理偏航」的改善:越界与推理失控率下降 85%,API 成本降 40%、输出速率提升超 30%,称其具备「资深架构师」级的端到端交付确定性。
「模型」频道最新
- Anthropic 工程师一条 prompt 让 Opus 5.5 做出带配乐的剪辑视频 — felixrieseberg · 2026-09-28
- Opus 5.5 引爆创意玩法,博主盘点 10 个 wild 案例 — CodeByPoonam · 2026-09-28
- 不用扩散模型:Opus 5.5 仅靠提示词生成 18 分钟视频,成本约 5 美元 — Afinetheorem · 2026-09-28
- AI 基准测试创业公司 Vals 获 a16z 领投 4000 万美元 A 轮 — dl_weekly · 2026-09-28
- 直接合并 Qwen3.6 与 3.8 27B,性能不差生成还更快 — Danmoreng · 2026-09-28
- Purz:LLM 不是黑洞,ComfyUI 仍是生成式 AI 的连接组织 — PurzBeats · 2026-09-28