RSIAgent 论文:免训练自改进框架让开源模型击败 GPT-6 等闭源模型
rohanpaul_ai · x · 2026-09-25
arXiv 论文《RSIAgent: Autonomous Exploration for Recursive Self-improvement in New Environments》(Sibo Zhu 等,50 页)提出免训练的多 Agent 递归自改进框架:协调课程(Curriculum)、执行(Actor)与校验(Verifier)三类 Agent,持续探索环境、验证结果,并将「行动-条件-后果」因果知识沉淀为可复用记忆。
关键设计是「先广后深」(broad-then-deep)探索:先并行广泛自探索发现环境结构,再聚焦深挖难例、隐藏约束、边界条件与未知因果依赖。产出的记忆冻结后可直接用于下游任务,无需更新模型参数。
在 OSWorld-v2 与 Agent's Last Exam 上,该框架显著提升强开源模型表现,使 Kimi-K3 和 GLM-5.3 超越 GPT-6 等前沿闭源模型。
所属事件:RSIAgent 免训练自改进框架让开源模型胜过 GPT-6(3 条相关)→
「编程与Agent」频道最新
- GPT-6 Astra + Jev 通关《求生之路2》:5 战役 23 章,耗时 13.8 小时 — imjustnewatai · 2026-09-26
- AI-first 时代做项目,你自己的理解也成了交付物 — brandon_xyzw · 2026-09-26
- DHH 称进入后开发时代,质疑者反问:为何执着 Rust — kristoph · 2026-09-26
- Sentry CEO:RAG 没死,上下文获取与优化仍是好 agent 的核心 — zeeg · 2026-09-26
- 用户让车里的 Grok 自动办停车证,建 bot 搜表单填完还盯消息 — Baconbrix · 2026-09-26
- Railway 推出免注册免费 VM,59 分钟起可跑智能体 — jasonkneen · 2026-09-26