Salesforce 研究:harness 共进化让弱模型补上模仿学习短板
Saleforce · hf · 2026-09-10
Salesforce 发表研究「Co-Evolving Harnesses and Models」,提出将 harness(执行环境/工具框架)与模型共同进化,并结合局部专家修正(on-policy correction)。
结果显示,这种方法能让较弱的模型在模仿学习失效的场景中迎头赶上,同时不打乱模型自身的规划风格,为提升小模型在 Agent 任务上的表现提供了新思路。
「编程与Agent」频道最新
- MCP 新工具 oracle-h:Agent 关键操作前强制人类 Telegram 审批 — modelcontextprotocol · 2026-09-10
- Codex 固定会话太多?手动拖入项目分组即可收纳 — vwxyzjn · 2026-09-10
- 模型跑偏就用 /goal:astra 编码助手的一个纠偏小技巧 — TheMoonMidas · 2026-09-10
- 图解缓冲区溢出如何覆盖 C 与 x86-64 的返回地址 — tetsuoai · 2026-09-10
- niji→GPT Image→MiniMax H3→Codex,打造像素完美动画全流程 — Hailuo_AI · 2026-09-10
- 开发者发布 Traser:自动定位「跑成功但结果错误」的 agent 运行 — Sensitive-Parsnip-12 · 2026-09-10