Sonnet 5.5 发布获「Opus 级」升级,写作能力反超旗舰
every · x · 2026-09-29
Dan Shipper 实测发布 Sonnet 5.5:写作能力大幅提升,在他基于真实工作的私有基准(Dan's Editorial Checks,7 模型 5 任务)中总分 65%,段落修订任务拿到 90% 的高分,写作上甚至优于 Opus 5.5;速度更快、价格更低,已成为团队快速迭代编码和设计工作的首选。
多位重度用户(hammermt 等)则提出「中端模型正在消失」的判断:模型栈只剩两端——旗舰(Opus/Fable)负责最难任务,超低价模型(Jev/Luna)负责跑量,中端模型已无生存空间,并猜测 OpenAI 停掉 Terra 也是同样原因。该基准上 GPT-6 Astra 以 82% 总分居首。
所属事件:Sonnet 5.5 实测:写作追平 Opus,token 半价但高 effort 消耗快(2 条相关)→
「编程与Agent」频道最新
- 用 Sonnet 5.5 做出可交互 3D 等离子球桌面壁纸,效果不输 Opus — chaseleantj · 2026-09-29
- 把 Agent 失败变回归测试:开发者用 Kitaru 搭建可回放评测工作流 — strickvl · 2026-09-29
- 开源 Collaborator:把终端、上下文和代码放上无限画布的 Agent 开发环境 — adnan_hashmi · 2026-09-29
- 几乎无人靠 MCP 服务器赚钱:按调用计费可行吗? — Prestigious_Lab_2998 · 2026-09-29
- 用 Codex 跑 5 天枚举全网已发表 AI 安全点子 — AaronBergman18 · 2026-09-29
- Sonnet 5.5 上线 Conductor,基准成绩图"出人意料" — charlieholtz · 2026-09-29