SkillGym 论文:用技能微调让 35B 模型超越多个旗舰模型

rohanpaul_ai · x · 2026-10-06

上海人工智能实验室等机构的论文 SkillGym(arXiv:2609.27717)提出把人类编写的 agent 技能文件从「推理时外挂指令」内化为模型自身能力:

结论:针对已验证工作流做微调(含基于结果的 RL),能让不依赖技能文件也更强的 agent 模型成为可能。

所属事件:上海AI实验室发布SkillGym,技能轨迹微调显著提升Agent能力(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →