SPADE:自我博弈实现环境难度的自动扩展

inductionheads · x · 2026-08-21

连续自我改进需要不断扩展的训练环境。SPADE 让同一个模型同时扮演环境设计者和推理 Agent,编写可执行的 Agent 环境并随着能力提升增加难度。这种方法实现了环境规模的自动扩展,无需人工干预。

所属事件:SPADE:自博弈让模型自建训练环境实现递归自我改进(10 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →