Opus 5.5 成 Latent Space 新默认模型,全行业 API 降价 40-50%
Latent Space · rss · 2026-09-23
Latent Space 的 AINews 周报详解 Claude Opus 5.5 发布与全行业降价潮:
发布要点
- Anthropic 发布 Claude 5.5 家族首个模型 Opus 5.5,宣称多数任务达到 Fable 5.1 水平,运行成本比 Opus 5 低 40%,速度快约 30%;OpenAI 约一小时后发布 GPT-6 Sol 与 Luna,价格比 GPT-5.6 低 50%。
- 首次强调写作改进:重要信息前置、遵循用户写作规则。Latent Space 实测 AINews 栏目后决定立即迁移到 Opus 5.5。
- 订阅权益:5 小时会话上限提升 20%,Pro/Max/Team 新增可随时使用的限额重置银行;成为 Claude Code 与 App 默认模型。Sonnet 5.5 与 Haiku 5.5 数周内推出,打破 Haiku 停更传言。
- 首个具备 Fable 5.1 级 cyber/bio/前沿研发安全防护的 Opus。
价格与 token 经济学
- 列表价降 20%($5/$25 → $4/$20 每百万 token),但 Vals 指出其在编码上常消耗更多 token。
- Artificial Analysis 分解:max effort 下单任务 $5.98,与 Opus 5 的 $5.86 几乎持平——「便宜 40%」仅在默认 medium 档成立。高 token 用量本会推高成本 80%,靠降价和更便宜的缓存读拉回。
- Cline 数据:以约 2.5 倍更低的成本在 Intelligence Index 上超过 Fable 5.1。
评测与异常
- 第三方成绩:FrontierSWE 62.3%(仅次于 GPT-6 Astra 65.5%)、CursorBench 57.8% 新榜首、ParseBench 表格 93.9%,但 LlamaIndex 认为图表/版式仍是短板且 $0.058/页的 OCR 成本偏高。
- 反直觉发现:xhigh effort 反而比 medium 多花 2.8 倍且得分低 3.2 分,@nrehiew 归因于高 effort 导致 scope creep,FrontierCode 会惩罚多余改动。
系统卡与其他
- 首次有实验室报告扩展到 100 个并行 agent 的多智能体规模化。
- ProgramBench 作者 OfirPress 指出其近 100% 解决率来自剔除最难程序的 166/200 子集,且通过率指标存在统计口径问题。
「公司和人」频道最新
- TestingCatalog 推出邮件版 AI 日报,爆料 GPT-6 与 Opus 5.5 同日发布 — testingcatalog · 2026-09-23
- Pydantic 作者吐槽 Chrome 安卓「听此页」功能完全不可用,批 Google 浪费 AI 能力 — samuelcolvin · 2026-09-23
- 被问何时能全自动取代自己,马斯克回答:我认为我已经做到了 — willdepue · 2026-09-23
- Elastic CTO 吐槽:LinkedIn 时间线上一半欧洲人都在 Mistral 上班 — jobergum · 2026-09-23
- 用 AI 教孩子的一线家长与教育者名单,涵盖家庭教育与创新学校 — thehiphopswami · 2026-09-23
- 马斯克:中国 AI 单位算力表现全球最佳,两三年内破解芯片瓶颈 — XFreeze · 2026-09-23