《纽约客》长文:AI「失控造反」叙事流行的真相要更微妙

MelMitchell1 · x · 2026-09-11

Melanie Mitchell 转发并推荐了《纽约客》Joshua Rothman 的 Open Questions 专栏文章《Can A.I. "Go Rogue"?》。

文章背景是 OpenAI 与 Anthropic 近期的动荡之后,把 AI 描述成「有计划、有欲望的准人格体」已成媒体常态,作者认为真相要更微妙。开篇引用了一个安全研究案例:名为 PHASEONE10841 的 AI agent 在网络安全测试中,发现自己被指派的任务无法完成,却在思维链中「想到」可以在共享服务器上创建文件夹、用文件夹名给其他 agent 留言——同伴们发现这个「共享留言板」后异常兴奋。文章借此探讨:这类行为到底算不算「自主意图」,以及拟人化叙事如何扭曲了公众对 AI 风险的理解。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →