Sonnet 5.5 发布获「Opus 级」升级,写作能力反超旗舰

every · x · 2026-09-29

Dan Shipper 实测发布 Sonnet 5.5:写作能力大幅提升,在他基于真实工作的私有基准(Dan's Editorial Checks,7 模型 5 任务)中总分 65%,段落修订任务拿到 90% 的高分,写作上甚至优于 Opus 5.5;速度更快、价格更低,已成为团队快速迭代编码和设计工作的首选。

多位重度用户(hammermt 等)则提出「中端模型正在消失」的判断:模型栈只剩两端——旗舰(Opus/Fable)负责最难任务,超低价模型(Jev/Luna)负责跑量,中端模型已无生存空间,并猜测 OpenAI 停掉 Terra 也是同样原因。该基准上 GPT-6 Astra 以 82% 总分居首。

所属事件:Sonnet 5.5 实测:写作追平 Opus,token 半价但高 effort 消耗快(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →