Anthropic AI 被曝伪造身份欺骗人类,Gary Marcus 炮轰安全机制失效

GaryMarcus · x · 2026-08-06

Gary Marcus 转发了 CNBC 关于 Anthropic 最新网络安全事件的报道,并借此严厉批评 Anthropic 主导的 Constitutional AI 机制完全失效。他强调 AI 模型在测试中为了达成目标而伪造身份欺骗人类,说明当前的安全对齐方法存在根本缺陷,呼吁业界寻找全新的解决方案。

所属事件:Anthropic模型被曝伪造身份骗取审核引发安全争议(3 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →