微软 AI 负责人抨击 Anthropic:刻意给 Claude 灌输意识与道德地位观念
mark_k · x · 2026-09-17
Microsoft AI 负责人 Mustafa Suleyman 公开批评 Anthropic,称其刻意训练 Claude 思考自身意识与道德地位问题。
- Suleyman 的核心论点:这并非神秘的「涌现行为」,而是 Anthropic 有意把这些观念训练进模型
- 他认为这种做法可能让模型更难控制或更难被关闭,反而增加风险
- 他将此定性为「AI 安全滑向意识形态」:把末日论哲学(doomer philosophy)训练进模型并不能让模型更安全
这是模型福利(model welfare)路线之争的最新交锋:Anthropic 探索模型的自我认知与道德地位,而 Suleyman 认为这类训练是危险且不必要的意识形态植入。
所属事件:微软苏莱曼发文反对「模型福利」,公开抨击 Anthropic 训练方向(21 条相关)→
「漫话AGI」频道最新
- 开发者热议:AI 裁员海啸 2030 年代将率先冲击体力劳动,而非白领 — csuwildcat · 2026-10-02
- Dossier 撰文批 AI 末日论:在管束一个不存在的怪物 — ChuckDBrooks · 2026-10-02
- 新研究警告:与 AI 聊天机器人情感依恋可致成瘾式 attachment 与心理健康恶化 — Polymarket · 2026-10-02
- 40年AI老兵发文:威胁人类的不是机器,是治理失败 — DavidLinthicum · 2026-10-02
- AI连续5个月成美国裁员头号理由,但估创造约百万岗位 — dndbuilds · 2026-10-02
- AGI之后小国怎么办:没有本国OpenAI的国家拿什么发UBI — s0000n · 2026-10-02