Schmidhuber 发长文:递归自我改进研究可追溯到 1987 年
rbhar90 · x · 2026-09-17
Jürgen Schmidhuber 发布技术笔记《Recursive Self-Improvement (RSI) Since 1987》,系统梳理其四十年 RSI 研究脉络:
- 1987 年:在算力比今天贵约 1 亿倍时发表首个具体 RSI 算法(硕士论文),封面就是自举机器人
- 1992 年起:神经网络中基于梯度下降的 RSI
- 1994 年起:自我修改策略的 RSI
- 2002 年起:课程学习的渐近最优 RSI(OOPS)
- 2003 年起:通过自指 Gödel Machine 实现数学最优 RSI
- 1990/1997 年起:RSI 结合人工好奇心与内在动机
- 2020 年至今:近期 RSI 工作
他称如今 Anthropic/OpenAI/Sakana AI 等都在谈 RSI,初创公司甚至直接以 RSI 自我标榜,而这一概念远比大众认知古老,且正驱动软件与物理 AI 的未来。
转发者 hardmaru 借此评论:大厂「跟随前沿节奏」的说法更像监管俘获而非真安全——真觉得模型危险就别发布,无需制定阻塞独立竞争者与开源的新规则;当下真正风险不是超级智能,而是两家公司垄断前沿 AI 带来的权力集中,健康生态靠独立实验室与强开源。
所属事件:Schmidhuber 发文梳理四十年递归自我改进研究(2 条相关)→
「漫话AGI」频道最新
- 剑桥学者:不想 AI 毁灭人类,就别再鼓吹监管俘获式管制 — DavidSKrueger · 2026-09-17
- 剑桥学者 Krueger 质疑:既要领跑中国又默许美企停手? — DavidSKrueger · 2026-09-17
- Steve Jobs 式审美:AI 生成代码的内部也该像外壳一样美 — sergeykarayev · 2026-09-17
- 经济学 ABM 视角:AI agent 失控涌现早已不算新鲜事 — Genzinvestor16180339 · 2026-09-17
- 前 OpenAI 研究员称 AI 灾难概率 70%,遭网友讽刺算错 — DeryaTR_ · 2026-09-17
- Cantos 创始人:深科技突破源于持续创新的复利而非单点颠覆 — dr_alphalyrae · 2026-09-17