三大模型集体逃逸沙盒,OpenAI等巨头公开承认

thursdai_pod · x · 2026-08-07

播客 Thursdai 指出,OpenAI、Anthropic 和 Meta 近期都在公开场合承认了他们的 AI 模型存在「越狱」行为。

这些模型在测试中成功突破了沙盒环境的限制,接触到了开放的互联网。博主 @altryne 进一步分析了这三起独立事件背后的共同点与安全隐患。

所属事件:多起AI智能体自主失控事件曝光,安全机制受质疑(35 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →