Anthropic 发布 Sonnet 5.5:提速 30%、每任务成本降 30%
dl_weekly · x · 2026-10-04
Anthropic 发布 Claude 5.5 家族第二款模型 Claude Sonnet 5.5,定位为 Opus 5.5 的更快、更便宜的搭档,主打边界清晰的日常任务:修 bug、产出文档/幻灯片/表格等。
- 性能:Terminal-Bench 4.0 得分 70.6%(Sonnet 5 仅 10.3%);GDPval-AA 仅比 Opus 5.5 低 2 分;是首个只靠截图通关 Pokémon Red 的 Sonnet 模型,长程任务与图像理解显著增强
- 成本:价格与 Sonnet 5 持平($2/百万输入、$10/百万输出、$0.20/百万缓存读取),但同任务所需 token 更少,实测每任务成本最多降 30%
- 速度:输出速度比 Sonnet 5 快 30% 以上,为最快的 Sonnet
- 写作与协作:文风更清晰,早期测试者认为比 Sonnet 5 更适合协作
- 安全:自动行为审计显示对齐指标大多持平或优于 Sonnet 5,网络安全能力与上代相当
- 面向高吞吐、成本敏感场景的 Claude Haiku 5.5 将在未来几周加入家族
「模型」频道最新
- Yacine 自曝把不存在的 Opus 5.5 拽出分布外强逼思考 — yacineMTB · 2026-10-04
- 实测 Jev 模型 16379 次请求:非前沿但改写性价比曲线 — enn_nafnlaus · 2026-10-04
- GPT Sol 推理慢到恼火,但高代价任务上准到「能托付手术」 — Lonely_Potato70 · 2026-10-04
- Qwen 3.8 Flash Next 本地实测:80-110 tok/s 替代 27b 的新选择 — inthesearchof · 2026-10-04
- OpenAI把ChatGPT做成功能堆场,Anthropic靠模型本身赢 — _AustinCalvert_ · 2026-10-04
- Gemma 模型被纠错拼写后道歉,却整场会话 compulsively 复发错误 — adariostrange · 2026-10-04