Anthropic 发布 Sonnet 5.5:Terminal-Bench 从 10.3 跳到 70.6,单任务成本降 30%
The Decoder · rss · 2026-09-29
Anthropic 发布 Claude 5.5 家族第二款模型 Claude Sonnet 5.5:输出速度快 30% 以上,单任务成本最高降 30%,在知识工作基准上几乎追平 Opus 5.5。
- 编码基准 Terminal-Bench 成绩从 10.3% 跃升至 70.6%
- Haiku 5.5 已官宣将在未来几周发布
- 届时 Anthropic 将拥有与 OpenAI 三款 GPT-6 模型一一对应的产品线
The Decoder 报道了上述全部数据。
「模型」频道最新
- 用户实测:GPT 最高推理档理论证明仍藏 bug — MvsCerezo · 2026-09-29
- 让 Opus 5.5 自己解释动画是怎么做的:它生成 2 分钟第一性原理讲解视频 — jnack · 2026-09-29
- Gemini 3.5 Pro 被砍:吐槽称正确做法是宣称「太危险不宜发布」 — signulll · 2026-09-29
- 实测:$200 Claude Code 订阅每月可白嫖约 9000 美元 Opus 用量 — RexDouglass · 2026-09-29
- Bindu Reddy 实测:「Sonnet 5.5」各档位都不行,不如 Sol 5.6 — bindureddy · 2026-09-29
- 同提示四模型横评:Claude Sonnet 明显胜过 OpenAI 两款模型 — sven_ai · 2026-09-29