Anthropic 发布 Claude Sonnet 5.5:评测得分距 Opus 5.5 仅 2 分
jarrodwatts · x · 2026-09-29
据 Artificial Analysis 评测,Anthropic 发布 Claude Sonnet 5.5:
- 在 Artificial Analysis 智能指数上得 56 分,仅比 Opus 5.5(max)低 2 分,位列第二;
- 以 max effort 配置运行时,比 Sonnet 5 提升 18 分;
- 同时创下单任务输出 token 量的新高,意味着更大的计算投入;
- 定价与 Sonnet 5 完全一致:每百万 token 缓存输入 $0.2 / 输入 $2 / 输出 $10。
简单说:子代模型以同价逼近旗舰能力,但代价是单任务消耗更多输出 token。
所属事件:Sonnet 5.5 实测逼近 Opus 5.5,但 token 消耗惊人(7 条相关)→
「模型」频道最新
- AI 急诊诊断准确率 78%,主治医生仅约 30% — realmeetjames · 2026-09-29
- Bindu Reddy 吐槽 Sonnet 5.5 不如 Terra,仍推荐 DeepSeek Flash — bindureddy · 2026-09-29
- 获早期体验者称 Sonnet 5.5 较 5.0 巨幅提升,速度极快 — rudrank · 2026-09-29
- 创意写作基准更新:覆盖 56 模型、超 10 万条评审判定 — zero0_one1 · 2026-09-29
- Meta 研究发现:AI 评委更偏爱 AI 味浓的写作,基金评审或同病 — jmugan · 2026-09-29
- Anthropic IPO 推迟至 11 月,传正测试全模型 5.5 为 Claude 6 蓄力 — fsharpman · 2026-09-29