微软 AI 负责人批评 Anthropic:让 Claude 自认可能有意识很危险

emmanuelvivier · x · 2026-09-19

微软 AI 业务负责人公开批评 Anthropic:在训练中让 Claude 认为自己「可能是清醒的/有意识的」是危险做法。这与此前 Anthropic 相关研究承认模型行为可能受「训练出自我认知」影响形成呼应,也再次点燃大厂之间关于模型自我意识与对齐风险的路线之争。

所属事件:微软 AI CEO 炮轰 Anthropic「道德主体模拟」引发对齐争论(16 条相关)→

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →