RAO 论文:递归训练简单任务可泛化到更难任务

a1zhang · x · 2026-07-27

这条转发在讨论论文 Recursive Agent Optimization(RAO) 的结果,以及一类“让 harness 帮模型泛化”的训练思路。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →