RSIAgent 免训练自改进框架让开源模型胜过 GPT-6

arXiv 论文 RSIAgent 提出 training-free 的智能体自改进方案:面对陌生应用环境,先由课程智能体自造练习任务并行「广逛」摸清界面结构,再针对难点深挖。实证显示该「先广后深」探索策略将 Agent 成功率从 56.5% 提升至 74.5%,无需训练任何参数即可让开源模型击败 GPT-6 等闭源模型,为高成本的重训路线提供了替代方案。

2026-09-24 ~ 2026-09-25 · 3 条相关