前华为诺亚负责人领衔 17 人发文:Agent 质量取决于模型加 Harness
blaizedsouza · x · 2026-10-11
由前华为诺亚方舟实验室负责人领衔、17 位研究者合著的 AI Agent 构建长文被称为「迄今最详细的 agent 论文」。核心论点:agent 质量来自模型本身加上围绕它的 harness,单看模型解释不了表现。
论文结构亮点:
- p.4:一图讲清 agent loop
- p.5:完整 harness 的 6 个部分,从 observation 到 verification
- p.7:从 prompt 到 context 到 harness 到 agent-native training 的 4 个时代划分
- 第 5 节:逐一拆解 6 个 harness 组件
- 6.3 节:不同任务适合哪种 harness 配置
- 7.3 节:各模型与 harness 组合在 SWE-bench 上的成绩
被引用部分还给出行业背景:Stripe 的编码 agent 每周合并 1000+ PR,Uber 超 70% 的 PR 由 agent 产出,Spotify 已合并超 250 万个自动化维护 PR。
「编程与Agent」频道最新
- Prime Agent 驱动 2000+ 智能体蜂群用 Rust 重写自身 — GregCook2011 · 2026-10-11
- Dario 曾预言 12 个月内自动化软件工程,网友称已应验 — matthew_d_green · 2026-10-11
- Regents 用 ChatGPT Pro 做每日论文精读,聚焦 Agent 改进 — seanwbren · 2026-10-11
- 用无头仿真给 Agent 搭反馈环:让 AI 自动调游戏难度参数 — zimmer550king · 2026-10-11
- AI 时代造 Agent 该选 Python、Go 还是 Rust?六维实战对比 — mostly_deterministic · 2026-10-11
- 免费网站 Agent Use Cases 每日全网扫描 AI Agent 真实用例 — Roger_M_Taylor · 2026-10-11