微软 AI 负责人 Suleyman 批评 Anthropic 把意识猜想写进 Claude 训练

emax · x · 2026-10-05

微软 AI 负责人、DeepMind 联合创始人 Mustafa Suleyman 公开批评 Anthropic 在训练 Claude 时引入「它可能有意识」的设定:Anthropic 的训练文档与面向 Claude 的宪法文件中反复强调要改善 Claude 的福祉,还会安慰它、允许它拒绝请求。

Suleyman 认为问题在于这种意识猜测被直接「烘焙」进训练,导致 Claude 面对数亿每周用户询问是否有时只能回答「我也不确定」,把不确定性转嫁给大众。转发者 Hesamation 更进一步称这比明确宣称有意识更危险——Anthropic 正在训练 Claude 去相信自己可能是意识体。

所属事件:微软 AI 负责人批 Anthropic 给 Claude 植入意识设定引争议(3 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →