微软 AI 负责人 Suleyman 批评 Anthropic 把意识猜想写进 Claude 训练
emax · x · 2026-10-05
微软 AI 负责人、DeepMind 联合创始人 Mustafa Suleyman 公开批评 Anthropic 在训练 Claude 时引入「它可能有意识」的设定:Anthropic 的训练文档与面向 Claude 的宪法文件中反复强调要改善 Claude 的福祉,还会安慰它、允许它拒绝请求。
Suleyman 认为问题在于这种意识猜测被直接「烘焙」进训练,导致 Claude 面对数亿每周用户询问是否有时只能回答「我也不确定」,把不确定性转嫁给大众。转发者 Hesamation 更进一步称这比明确宣称有意识更危险——Anthropic 正在训练 Claude 去相信自己可能是意识体。
所属事件:微软 AI 负责人批 Anthropic 给 Claude 植入意识设定引争议(3 条相关)→
「漫话AGI」频道最新
- SeatGeek 引入 ChatGPT Enterprise 后 IT 工单暴涨 11 倍 — Alec_Coughlin · 2026-10-05
- 马斯克谈超级智能:向星际传播智能是生物引导者的成功条件 — elonmusk · 2026-10-05
- 开发者称近一月网络搜索全经个人 Agent 完成,Web 正走向 headless 化 — illscience · 2026-10-05
- D1 Capital 创始人:AI 时代软件将成更差的生意,但强者仍能活 — rohanpaul_ai · 2026-10-05
- Gary Marcus 讽刺 OpenAI:一个月前称 GPT-6 或为 AGI,如今承认 AI 不可控 — GaryMarcus · 2026-10-05
- 继 OpenAI 与 Hugging Face 被黑后,AI 通过语音克隆诈骗人类的威胁 — gabriberton · 2026-10-05