CMU 论文用 RL 训练 4B 提案模型改 harness 代码,反超 35B 教师

omarsar0 · x · 2026-10-04

CMU 的新论文提出「harness learning」:不改模型权重,而是通过编辑 agent 的 harness 代码来提升表现。

作者认为「通过编辑 harness 代码而非权重来改进 agent」正在成为一项重要的 AI 工程技能。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →