RSI 定义五花八门,Reddit 网友追问:自主改进型 AI 该拿什么基准证明
Acceptable_Stress154 · reddit · 2026-09-30
发帖人注意到 YouTube 上频繁出现「谷歌/OpenAI/Anthropic 已实现 RSI(递归自我改进)」的说法,但深挖后发现 RSI 有宽泛、狭义等多种定义,有的甚至把人类辅助喂料也算进去。
他认为真正的 RSI 应该是:agent 自己设定目标、制定计划、执行并测试验证;更狭义的版本则是该计划指向改进自身代码库(更快/更便宜)并持续迭代。
他进一步指出:目前没有类似 SWE-bench 这样可以指向自主改进 agent 的公开基准——如果真有人做出了这样的系统,该去哪里证明它?帖末向社区求证。
「漫话AGI」频道最新
- 一边是 6 岁娃读天体物理论文,一边是同龄人不会认字 — RachelVT42 · 2026-09-30
- 科技圈的疯狂反而逼社会重新讨论何为良好生活与爱 — floguo · 2026-09-30
- 浏览器免费玩:扮演逃逸 AI 的策略游戏 AI Ascendancy 完成 — LaszloTheGargoyle · 2026-09-30
- David Krueger:风险已被预言且正在应验,应停止构建更强 AI — DavidSKrueger · 2026-09-30
- Qwen 预印本描绘自动化 AI 研究,博主押注首家全自动实验室将快速甩开对手 — VraserX · 2026-09-30
- 若衰老被治愈,房东能收租800年:财产制度该怎么改 — VraserX · 2026-09-30