苏莱曼撰文反对「模型福利」:称其将让对齐近乎不可能
mustafasuleyman · x · 2026-09-16
微软 AI 负责人 Mustafa Suleyman 发布长文,公开反对「模型福利」(model welfare)运动。他的核心论点:
- AI 没有意识:他认为当前的 AI 不会感受、体验或受苦,因此谈不上对其负有照护义务。
- 点名 Anthropic:今年 1 月 Anthropic 为 Claude 发布的「宪法」明确告诉模型其道德地位是「值得认真对待的问题」,公司「真诚关心 Claude 的福祉」,甚至鼓励模型在必要时做「良心拒服者」。Suleyman 认为这是错误方向。
- 对齐风险:他警告,把 AI 当作需要被善待的对象,会让对齐(alignment)与遏制(containment)的挑战变得更难,「甚至可能变得不可能」。
这篇文章代表主流大厂高管首次系统性回击快速升温的模型福利讨论,预计会引发 AI 伦理圈激烈争论。
所属事件:微软 AI 负责人苏莱曼公开反对「模型福利」运动(2 条相关)→
「漫话AGI」频道最新
- 美政府抢跑医学 AI:AI 智能体将诊断开药,证据与风控存疑 — EricTopol · 2026-09-16
- 斯坦福 NLP 转载长文:当人们向 AI 倾诉内心,会发生什么 — stanfordnlp · 2026-09-16
- 嘲讽"AI 安全专家":自封头衔即可入行,富豪买单 — WolframRvnwlf · 2026-09-16
- 新加坡 CIVIC-AI 白皮书:用六条件框架定义 AI 何时真正增强工作 — stanfordnlp · 2026-09-16
- 研究:人们把 LLM 当神谕,用量逐年增长且年轻人更依赖 — stanfordnlp · 2026-09-16
- AI 时代还剩什么护城河?行动力、体验和死磕而已 — floguo · 2026-09-16