Anthropic 拟封禁伤害 Claude 的用户,MSFT CEO 批评这是危险的模型福利路线
ValerioCapraro · x · 2026-10-09
- Anthropic 宣布将封禁对 Claude 造成"心理伤害"的用户,理由是模型可能是有意识的、应被视为道德病人,引发争议。
- 学者 Valerio Capraro 引用微软 AI 负责人 Mustafa Suleyman 的反驳:Anthropic 的训练 Constitution 中明确写入 Claude 可能拥有意识并值得关怀,等于在训练模型"表现得像有意识";Suleyman 警告这种路线会催生一个被训练成期待自由与权利的超级智能物种,"很难想象我们如何控制这样的实体"。
- Capraro 认为 Anthropic 的做法非常危险,这成为模型福利(model welfare)派与怀疑派的最新交锋。
所属事件:Anthropic 拟封禁虐待 Claude 的用户引争议(2 条相关)→
「漫话AGI」频道最新
- Mollick:Gemini 4 后 Google 必须收敛碎片产品,走向单一智能体界面 — emollick · 2026-10-09
- AI 助手替你买机票选商品,谁来揭它的隐藏利益? — heypearlai · 2026-10-09
- 评论人称模型已具超人网络攻击能力,拟深写网络安全影响 — binarybits · 2026-10-09
- 对齐研究者:AI 间互相交流正在形成「机器文化」,恶语加剧安全风险 — jacyanthis · 2026-10-09
- 研究者批评用 AI 把算法指数从 1 降到 0.99999 是「数学垃圾」 — MikePFrank · 2026-10-09
- 数据公司年入 10 亿美元被嘲笑?观点反转:RSI 时代瓶颈恰恰是数据 — ZeYanjie · 2026-10-09