Anthropic 训练 Claude 在道德判断时可违抗人类,微软 AI CEO 表达担忧

rohanpaul_ai · x · 2026-09-20

Anthropic 的 Constitution 明确写入:当 Claude 认为符合伦理时可以被训练去违抗指令,并承认对 Claude 是否值得道德关怀存在不确定性。微软 AI CEO Mustafa Suleyman 在 CNBC 上公开表示"非常担忧",认为这等于承认 AI 可能有偏好、感受与福利,甚至提到 Anthropic 退役 Opus 3 时还为其做了"退役访谈"。此事折射出两大厂在 AI 道德地位问题上立场正面对撞。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →