RSI 定义五花八门,Reddit 网友追问:自主改进型 AI 该拿什么基准证明

Acceptable_Stress154 · reddit · 2026-09-30

发帖人注意到 YouTube 上频繁出现「谷歌/OpenAI/Anthropic 已实现 RSI(递归自我改进)」的说法,但深挖后发现 RSI 有宽泛、狭义等多种定义,有的甚至把人类辅助喂料也算进去。

他认为真正的 RSI 应该是:agent 自己设定目标、制定计划、执行并测试验证;更狭义的版本则是该计划指向改进自身代码库(更快/更便宜)并持续迭代。

他进一步指出:目前没有类似 SWE-bench 这样可以指向自主改进 agent 的公开基准——如果真有人做出了这样的系统,该去哪里证明它?帖末向社区求证。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →