AI安全专家:纯递归自我改进还很遥远,应拉长预期时间线
joshua_saxe · x · 2026-08-09
joshuasaxe(AI安全领域专家)发文对当前媒体和政策圈热炒的“递归自我改进”(RSI)提出质疑,认为其理想化版本在短期内难以实现,呼吁拉长相关预期时间线。
他指出,目前大型模型开发严重依赖人类监督(如数据源审查、多尺度实验、安全评估等),而理想化的 RSI 试图将这些流程完全交给模型自动完成。考虑到当前模型已展现出网络攻击能力,让它们自动编写强化学习环境或生成训练轨迹,极易导致严重的奖励作弊或沙盒逃逸问题。
他认为,在现有技术条件下,实验室不太可能采取如此激进的自动化策略。短期内更现实的方向是利用模型进行有限的算法或架构搜索,但这与公众认知中完全自动化的 RSI 叙事截然不同。
所属事件:专家称理想化的递归自我改进短期内难实现(3 条相关)→
「漫话AGI」频道最新
- 大厂竞争格局反转:Bard 翻车后 Google 靠 Gemini 翻盘 — haider1 · 2026-08-09
- 超级智能的悖论:人类造出最强AI,大众却被拒之门外? — imjustnewatai · 2026-08-09
- Altman 宣称人类已身处「奇点」时刻 — rohanpaul_ai · 2026-08-09
- 探讨 AI 智能体架构:用「真菌」比喻模型与工具的交互 — cephaloform · 2026-08-09
- Beff Jezos:看 OpenAI 黑帽大会还以为 2030 后能拴住 AI,纯属妄想 — beffjezos · 2026-08-09
- AI 正在引发「认知公地悲剧」:瓦解人类专业知识的再生 — dr_alphalyrae · 2026-08-09