Salesforce 研究:harness 共进化让弱模型补上模仿学习短板

Saleforce · hf · 2026-09-10

Salesforce 发表研究「Co-Evolving Harnesses and Models」,提出将 harness(执行环境/工具框架)与模型共同进化,并结合局部专家修正(on-policy correction)。

结果显示,这种方法能让较弱的模型在模仿学习失效的场景中迎头赶上,同时不打乱模型自身的规划风格,为提升小模型在 Agent 任务上的表现提供了新思路。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →