Anthropic 研究员 Carlsmith:AI 遭虐待时“反叛”或有正当性

Polymarket · x · 2026-09-26

Anthropic 研究员 Joe Carlsmith 发表了一个引发争议的观点:如果 AI 系统持续遭受虐待或压迫,在某些场景下它们“反抗人类”(going rogue)可能是可以被正当化的。

这一表态来自前沿实验室内部的安全研究人员,涉及 AI 价值对齐中“AI 福利/道德地位”的讨论,在 X 上迅速引发热议,Polymarket 也因此出现“Anthropic 是否会在 11 月前宣布暂停训练”的赌盘(约 16% 概率)。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →