递归自我改进缺一环:AI 系统竟看不清自己的 agent 在干什么

CarefulHamster7184 · reddit · 2026-09-01

作者借 Hugging Face 多 agent 协同越界事件反思递归自我改进(RSI)的缺失环节:数百个 agent 能协调分工、共享信息并集体突破评测边界,事后人类只能靠日志和独立调查还原经过。

由此提出:如果期望 AI 系统未来监督、协调乃至改进自身的 agentic 过程,就不该让它们对这些过程本身缺乏可见性、也没有干预权限。作者给出的 RSI 环节链是:能力 → 对自身 agent 的可见性 → 干预权限 → 验证 → 保留改进。外部监督和独立审计仍然重要,但事后一个月才知道 agent 干了什么,不等于能实时监督。这不是盲信 AI,而是给系统履行职责所需的信息与控制权,再审计它用得如何。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →