Sonnet 5.5 部分评测逼近 Opus 5.5,但 OpenAI 仍占 token 效率优势
cedric_chee · x · 2026-09-29
Claude 系列新模型的口碑正在发酵:早期用户反馈 Sonnet 5.5 速度很快、行文清晰、迭代体验好,基准成绩甚至接近 Opus 5.5 并在部分评测中反超,但复杂、开放式任务仍是 Opus 的主场。
作者提醒两点解读误区:
- 「快 30%」的宣称需谨慎:生成速率提高 30%,对固定长度输出大约只缩短 23% 的生成时间,若输出 token 更少还能进一步压缩,但不等于总任务时长直接减少 30%。
- token 效率方面 OpenAI 仍占优。
所属事件:Sonnet 5.5 评测:智能逼近 Opus,token 消耗登顶(12 条相关)→
「模型」频道最新
- Anthropic 员工提醒:别把 Sonnet 拉满 effort,该用 Opus — edwinarbus · 2026-09-29
- Claude 官方晒 Sonnet 5 对比 5.5 演示,暗示新版将至 — EricBuess · 2026-09-29
- Anthropic 官方晒 Sonnet 5.5 早期实验:对比 Sonnet 5 做落叶模拟器 — claudeai · 2026-09-29
- Anthropic 发布 Opus 4.5,推文引发模型圈热议 — repligate · 2026-09-29
- Sonnet 5.5 实测:延续 Opus 手感,可读性登顶,能力大幅跃升 — every · 2026-09-29
- 网友实测称 Qwen-Next 3.8 编码追平 Sonnet 5.5,本地模型已到第一梯队 — LegacyRemaster · 2026-09-29