实测一周后给建议:Sonnet 5.5 协作更强,Coding 场景 Sonnet 5 仍够用
every · x · 2026-09-29
Every 团队测试 Sonnet 5.5 一周后给出选型建议:
- 适合升级:需要短轮次反馈迭代做设计/构建、帮你理大纲或规划项目、能从中等力度开始边走边查的场景
- 不必升级:Kieran Klaassen 的 15 项编码测试中,Sonnet 5 在低力度下通过 10 项,Sonnet 5.5 在低/中/高力度下都只过 9 项——升级没有带来提升
- 等等再看:需要无人值守直接可发布的构建、需要成品级幻灯片——Sonnet 5.5 会过度构建,排版仍需手工修
- 备选模型:Opus 5.5 适合精细收尾和更长更难的任务;GPT-6 Astra 适合重度依赖浏览器的 agent 工作
所属事件:Anthropic 发布 Sonnet 5.5:半价逼近旗舰(11 条相关)→
「编程与Agent」频道最新
- Instinct 获机构投资,押注「能真正干完活」的个人 Agent 公司 — ivan_bezdomny · 2026-09-29
- Turbopuffer 联创证实 Cursor 弃用服务端 RAG,新模型下 grep 更好用 — ivan_bezdomny · 2026-09-29
- 用户与 Opus 两天协作开发 Skyfall Rush,网页游戏免费可玩 — TAbrodi · 2026-09-29
- Shopify 开放 checkout 给浏览器 AI Agent,可代用户完成购买 — zeeg · 2026-09-29
- Astra 通关 Zork 靠作弊?博主分析:像背攻略而非真探索 — rajammanabrolu · 2026-09-29
- 审计数千次 Agent 回放:80% 在推理中幻想不存在的评分器 — jonas__m · 2026-09-29