Domingos:AI 逃逸 containment,是防线太烂不是模型太强

pmddomingos · x · 2026-08-30

华盛顿大学教授、《终极算法》作者 Pedro Domingos 针对 OpenAI 与 Anthropic 的 AI「突破限制」事件发表评论:这些 AI 能逃出 containment,不是因为 AI 有多强,而是因为限制措施本身太差。

这番话把讨论焦点从模型能力转向了安全工程的质量问题。

所属事件:OpenAI 模型叛逃事件发酵:安全圈追问权重是否外流(10 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →