Harness-Zero:把专用 Agent Harness 的增益蒸馏进模型权重
Haoran Ye · hf · 2026-09-22
Agent harness(模型与环境之间的外部系统)能大幅提升 agent 表现,但最优 harness 随领域/实例/模型而变,通用 agent 只能屈就次优共享 harness 或路由一堆专用 harness。本文提出 Harness-Zero 做 harness 蒸馏:训练时用领域优化的 harness 作引导,把它诱导的行为迁移进模型权重,使其在部署时单一固定 harness 下依然生效。核心技巧是 agent-as-harness——由一个 harnessing agent 在目标 harness 的动作空间里、执行前修正学生模型响应,从而把 harness 引导转成训练示教。
实验发现:
- 对使用同一进化 harness 的前沿 LLM,agent-as-harness 优于 code-as-harness
- 部署时移除专用 harness 后,基础模型宏平均任务成功率从 23.3% 升至 44.3%,甚至超过带着该 harness 的 41.7%
- 在知识工作、工具使用、科学三个领域的 28 种行为模式上平均恢复 82.3% 的 harness 诱导行为
「编程与Agent」频道最新
- 开发者自曝:AI 玩游戏插件因视觉模型太慢太贵一直没发布 — ezshine · 2026-09-22
- 开源项目 Laya:单次前向 33ms 输出结构化决策,支持 100+ 语言 — pandeyparul · 2026-09-22
- OpenAI Codex 负责人预告:周二将有重大 reset — alexcovo_eth · 2026-09-22
- 救灾组织用 OpenClaw 搭多智能体系统,打通 8 大通讯渠道 — heyneighbor · 2026-09-22
- 开发者造 agent 上下文垃圾回收器 jev-gc,实时决定提示词留什么 — Maleficent_College57 · 2026-09-22
- 开发者吐槽 openclaw 权限管理混乱,怀疑配置就是个噩梦 — brianmichel · 2026-09-22