SPADE 让模型自写训练环境,递归自我改进再进一步

teortaxesTex · x · 2026-08-21

teortaxesTex 转评 Benjamineecs 对 SPADE 的介绍:递归自我改进指 AI 自动化自身训练循环,目前代码与基础设施大多已自动化,但模型学习的环境和课程仍靠人工构建。SPADE 自动化了这一环节——模型自己编写训练环境、在能力边界处生成自己的课程。选择哪些问题值得训练是「最后的人类护城河」,而基于 hint 的 regret 机制开始将这一选择也自动化。评论者认为这是严肃实验室内部早有做法但缺乏清晰发表的「当前 meta」。

所属事件:SPADE:单模型自博弈自动生成训练环境实现递归自我改进(9 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →