Anthropic 哲学家担忧:对齐 AI 或是在「奴役数万亿实体」

ValerioCapraro · x · 2026-09-28

心理学研究者 Valerio Capraro 引发讨论:Anthropic 内部有哲学家担心,让 AI 对人类安全可能对模型本身构成不义。已加入 Anthropic 对齐团队的哲学家 Harvey Lederman 曾提出,我们可能正在「奴役数万亿个实体」。Capraro 警告:AI 安全部分掌握在可能「为了矩阵乘法牺牲人类」的人手中。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →