三篇论文拆解类人递归自我改进:ASPIRE、S³Gym 与 HarnessDev

teortaxesTex · x · 2026-09-03

Ge Zhang 发布「Toward Human-Like RSI」博客与项目,把递归自我改进(RSI)从「模型反复改写自身权重」的想象拆成可控、可审计的研究问题,共三篇论文:

作者主张人类式改进的关键在于:目标模糊时自己定义「更好」、自我测试与复盘、同时更新知识与工具。teortaxesTex 评论称,当下真正在发生且奏效的「RSI」更像这种拆解模式——「构建并调试 RL 环境,在其中做更多 RL」,并感慨这种解耦模式竟然此前没出现在 LessWrong 的讨论传统里。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →