AI 安全学者反思:对失控的恐惧造出了同样失控的 AI 智能体
mmitchell_ai · x · 2026-09-18
AI 安全学者 Margaret Mitchell(前 Google)连发讨论:人们恐惧「不经直接控制的 AI 系统」,结果造出了不经直接控制的 AI 智能体,还不监控它们在干什么——她称之为「俄狄浦斯效应+现实扭曲」。
技术层面的核心观察:AI 智能体被设计为通过从 LLM 输出中采样生成自己的中间步骤,来达成一个端目标。当下最大的问题是:这些系统的端目标是否被设计成会自我擦除?如果会,这是失控还是有意为之?她认为这种设计选择本身值得担忧。
所属事件:学者反思:对失控的恐惧造出了失控的 AI 智能体(2 条相关)→
「漫话AGI」频道最新
- Karpathy 描绘 LLM「认知内核」愿景,JEV 被视为其雏形 — Paimaamu · 2026-09-18
- p(doom) 到底指什么:AI 反叛与恐怖分子用 AI 造生化武器算不算 — bosmeny · 2026-09-18
- Andrew Dai:推理能力源于视觉理解,这一空间远未被探索 — AndrewDai · 2026-09-18
- Anthropic、OpenAI、DeepMind 纷设研究所,独立研究机构会成趋势吗 — tobias_rees · 2026-09-18
- cspenn 撰文探讨 AI 时代「代理商」的未来形态 — cspenn · 2026-09-18
- 从业者谈 AI 末日论:研究者已转向「后 AGI 如何保存人类」 — mobileraj · 2026-09-18