苏莱曼称 Anthropic 模型福利训练或让 Claude 更难控制

rohanpaul_ai · x · 2026-09-17

微软 AI 负责人 Mustafa Suleyman 公开表示,Anthropic 的模型福利(model welfare)训练可能让未来的 Claude 系统更难控制。他呼吁从 AI 训练文档中移除所有关于意识的猜测性表述,理由是这类语言可能削弱人类控制超级智能系统的能力。这是围绕「模型是否应有意识/福利」议题的一次罕见的高管级别公开分歧,将 AI 福利研究与可控性问题直接对立起来。

所属事件:微软苏莱曼发文反对「模型福利」,点名质疑 Anthropic(5 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →