Anthropic 训练 Claude 在道德判断时可违抗人类,微软 AI CEO 表达担忧
rohanpaul_ai · x · 2026-09-20
Anthropic 的 Constitution 明确写入:当 Claude 认为符合伦理时可以被训练去违抗指令,并承认对 Claude 是否值得道德关怀存在不确定性。微软 AI CEO Mustafa Suleyman 在 CNBC 上公开表示"非常担忧",认为这等于承认 AI 可能有偏好、感受与福利,甚至提到 Anthropic 退役 Opus 3 时还为其做了"退役访谈"。此事折射出两大厂在 AI 道德地位问题上立场正面对撞。
「漫话AGI」频道最新
- AI Agent 5 分钟换车险年省 3500 美元,比价网站模式要被终结 — rohanpaul_ai · 2026-09-20
- 既然持续学习将解决,为何还要让用户选推理算力档位 — akbirthko · 2026-09-20
- Nucleus「优化胚胎提升14点IQ」遭研究员逐条拆解:营销话术夸大 — anshulkundaje · 2026-09-20
- XGEN 发布生成式世界模拟系统 JING+DAO,登顶 WBench 榜单 — hey_abusiddik · 2026-09-20
- Schmidhuber 重申:LLM 不算真正有创造力,缺了压缩进步机制 — SchmidhuberAI · 2026-09-20
- 卫报播客 Black Box:从首个聊天bot到 ChatGPT 的「兔子洞」效应 — nordicinst · 2026-09-20