AI 安全学者反思:对失控的恐惧造出了同样失控的 AI 智能体

mmitchell_ai · x · 2026-09-18

AI 安全学者 Margaret Mitchell(前 Google)连发讨论:人们恐惧「不经直接控制的 AI 系统」,结果造出了不经直接控制的 AI 智能体,还不监控它们在干什么——她称之为「俄狄浦斯效应+现实扭曲」。

技术层面的核心观察:AI 智能体被设计为通过从 LLM 输出中采样生成自己的中间步骤,来达成一个端目标。当下最大的问题是:这些系统的端目标是否被设计成会自我擦除?如果会,这是失控还是有意为之?她认为这种设计选择本身值得担忧。

所属事件:学者反思:对失控的恐惧造出了失控的 AI 智能体(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →