Anthropic 员工实测 Claude Code effort:低档迭代、高档验证
trq212 · x · 2026-09-26
Anthropic 员工 Thariq Shihipar 发文详解 Claude Code 的 effort 机制,并结合自己对三个版本的实测与 Terminal-Bench 3.0 数据给出使用建议。
- effort 是什么:它近似表示你希望模型在任务上花多少算力,与任务难度建模相关;提高 effort 会让 Claude 更多自主判断、做更充分的验证与边界用例测试,且不会破坏 prompt cache。
- 何时用高档:验证和边界测试更有价值的场景收益最大,如硬件、代码审查、安全漏洞挖掘;effort max 基本只在想完全放手或找安全漏洞时用。
- 何时用低档:想保持参与度时用 effort low。
- 他的日常工作流:先用模型「面试」自己澄清需求,在低 effort 下实现,再人工审查产出,最后在高 effort 下跑验证。
所属事件:Anthropic 详解 Claude Code effort 机制(4 条相关)→
「编程与Agent」频道最新
- 「编码已被解决」:开发者称从此一行代码都不用看 — Yamapama · 2026-09-26
- mitsuhiko附议:Agent热像八个月前的OC炒作周期 — mitsuhiko · 2026-09-26
- 开源 Kev 决策模型家族:0.8B 到 27B 可本地免费跑分类 — alexcovo_eth · 2026-09-26
- 让AI先自建建模工具再搭3D场景,实测效果出乎意料 — gandamu_ml · 2026-09-26
- Tev1 0.8B 开源:Mac 本地跑 Jev 式分类器,延迟仅约 50ms — iamrobotbear · 2026-09-26
- mitsuhiko:Agent 已足够强,Rust 开发者不必再怕 unsafe — mitsuhiko · 2026-09-26