苏莱曼称 Anthropic 模型福利训练或让 Claude 更难控制
rohanpaul_ai · x · 2026-09-17
微软 AI 负责人 Mustafa Suleyman 公开表示,Anthropic 的模型福利(model welfare)训练可能让未来的 Claude 系统更难控制。他呼吁从 AI 训练文档中移除所有关于意识的猜测性表述,理由是这类语言可能削弱人类控制超级智能系统的能力。这是围绕「模型是否应有意识/福利」议题的一次罕见的高管级别公开分歧,将 AI 福利研究与可控性问题直接对立起来。
所属事件:微软苏莱曼发文反对「模型福利」,点名质疑 Anthropic(5 条相关)→
「漫话AGI」频道最新
- 「有了飞机就扔掉自行车」:深层学习旧成果正被 Transformer 热潮掩埋 — cephaloform · 2026-09-17
- Altman 称内部模型 Astra 已能做最强数学家做不到的事 — haider1 · 2026-09-17
- AI 安全圈内讧:CAIS 区分「亲人类安全」与 EA 实验室安全路线 — S_OhEigeartaigh · 2026-09-17
- 杜克 Work at Frontier 报告:AI 最常把营销客服任务嵌入各职业 — daveholtz · 2026-09-17
- Kath McMahon:AI 能力越强生物风险越高,防御不会自动跟上 — graceisford · 2026-09-17
- 投资人观察:AI 剧变期涌现 exceptional 年轻创始人,让部分基金措手不及 — pzakin · 2026-09-17