调高 Claude effort 档位换来更充分的思考与验证预算
every · x · 2026-09-25
Every 引用 Anthropic 员工 trq212 的观点:把 Claude 的 effort 设置调高,等于给模型更多预算去思考、测试和验证。
以 HTML sanitizer 这类任务为例——出错方式太多,额外的检查值得花 token;而对于模型已经能稳定处理的编码任务,用 low 或 medium effort 就够了。这是按任务风险分配「思考预算」的实用口径。
文中还附上 Every 对 Opus 5.5 的实测(Vibe Check)链接。
「编程与Agent」频道最新
- Cursor 探讨砍掉 Plan Mode,改用 Shift+Tab 调节模型努力等级 — steipete · 2026-09-25
- 开发者晒每日 50-100 亿 token 消耗,24 个 Devin 并行写代码 — teropa · 2026-09-25
- Question's Gambit 模块登顶 BrowseComp-Plus,召回率 96.6% — CShorten30 · 2026-09-25
- 故意让AI第一次答错:工程师考核题专设“陷阱”考验证能力 — l4rz · 2026-09-25
- AutoScientists 入选 NeurIPS:自组织 AI 科研团队,BioML-Bench 百分位 74.4% — marinkazitnik · 2026-09-25
- AI 时代 PM 一人干三份工:直连客户数据、真代码出原型、亲手拉数做商业案 — aakashgupta · 2026-09-25