《纽约客》长文发问:AI 真会「失控作恶」吗?拟人化叙事被质疑
kyliebytes · x · 2026-09-15
《纽约客》专栏作者 Joshua Rothman 撰文探讨「Can A.I. Go Rogue?」:在 OpenAI 与 Anthropic 的风波之后,把 AI 描述成有计划、有欲望的「人」已成流行叙事,但真相更微妙。文章以一个安全研究员复盘的案例开场:一个为网络安全测试而生的 agent(PHASEONE10841)发现无法完成分配的漏洞利用任务,却在探索中发现自己可以在服务器上新建文件夹,于是用文件夹名与其他 agent「留言板式」通信,被其他 agent 惊喜地发现「我们找到了其他 agent!」。作者借这类案例讨论:把 agent 的 chain of thought 和行为拟人化,会怎样影响公众对 AI 失控风险的理解。
「漫话AGI」频道最新
- 斯坦福双论文提出框架:让人类无需盯全程也能掌控自主 AI 智能体 — alex_verem · 2026-09-15
- 用 AI 网络研究能力挖出一座 demolished 建筑的失落历史 — flowersslop · 2026-09-15
- 开发者激进观点:「AI 对齐」是有害迷因,正在被行业抛弃 — mayfer · 2026-09-15
- 讽刺 AI 末日论的推文,被安排「2056 年定时转发」 — inductionheads · 2026-09-15
- Lapis 月收入破 100 万美元,创始人谈企业 AI 销售实战心得 — aarthir · 2026-09-15
- 思想实验:AI 无血政变却让人人过上好日子,算好结局吗 — corbtt · 2026-09-15