Agent 动态调节推理强度,DeepSWE 与 Terminal-Bench 4.0 登顶性价比前沿

_jzhao · x · 2026-09-30

jzhao 团队撰文介绍其 Agent 的两项更新:一是让 Agent 动态选择自身推理 effort,在简单任务上少花算力、难任务上加大投入;二是改进了向子 agent(subagents)分派工作的交接能力。

作者称这些改动使其在 DeepSWE 和 Terminal-Bench 4.0 上处于成本-性能曲线的前沿位置。作者随后补充观点:这是「苦涩的教训」再次应验——应当押注模型本身变得更聪明,工程侧要做的是保证 harness(脚手架)不拖后腿。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →