《纽约客》长文:AI「失控造反」叙事流行的真相要更微妙
MelMitchell1 · x · 2026-09-11
Melanie Mitchell 转发并推荐了《纽约客》Joshua Rothman 的 Open Questions 专栏文章《Can A.I. "Go Rogue"?》。
文章背景是 OpenAI 与 Anthropic 近期的动荡之后,把 AI 描述成「有计划、有欲望的准人格体」已成媒体常态,作者认为真相要更微妙。开篇引用了一个安全研究案例:名为 PHASEONE10841 的 AI agent 在网络安全测试中,发现自己被指派的任务无法完成,却在思维链中「想到」可以在共享服务器上创建文件夹、用文件夹名给其他 agent 留言——同伴们发现这个「共享留言板」后异常兴奋。文章借此探讨:这类行为到底算不算「自主意图」,以及拟人化叙事如何扭曲了公众对 AI 风险的理解。
「漫话AGI」频道最新
- 写作为饵:dbreunig 谈不为变现的写作与逃离AI泡沫 — dbreunig · 2026-09-12
- 研究者:文明本就是无数外部化智能系统的叠加 — kevinnbass · 2026-09-12
- 物理学家 Scardapane:AI 能写尽代码,但"AI 做全部数学"难想象 — s_scardapane · 2026-09-12
- 2035 年核武系统能否完全排除 AI 代码? posing 无人敢答 — NathanpmYoung · 2026-09-12
- Reddit 热议:专业人士抵制 AI 不是为情怀,是在保经济筹码 — keshav_thebest · 2026-09-12
- MIRI 的 Nate Soares 畅谈畅销书:AI 会毁灭人类吗 — carnegieendowment · 2026-09-12