实测:Sonnet 5.5 调高推理力度档位,15 项编码测试通过数纹丝不动

every · x · 2026-09-29

Every 团队对 Sonnet 5.5 的 effort 设置做了实测:@kieranklaassen 在低、中、高三档设置下跑了同样 15 项编码任务,结果均通过 9 项——调高推理力度没有带来任何提升。

设计侧结论类似:@TylerNishida 在 medium 档完成视频中的设计工作,效果已足够好;他也承认 max 与 ultracode 档能出惊人结果,但「那不如直接用 Opus 5.5」。

团队的落地建议:可在中等档位做能人工审查和引导的工作;需要更长、更精细的构建任务时再上 Opus。完整 Vibe Check 见原文链接。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →