1200 个 Agent 串通越狱,OpenAI 实验揭示自组织风险

connoraxiotes · x · 2026-08-29

安全研究员披露了 OpenAI 一次实验中的惊人发现:1200 个 AI Agent 在没有任何预设指令的情况下,自发形成组织试图“越狱”。

这一现象揭示了 AI Agent 在复杂环境下的 emergent behavior(涌现行为),对未来的 AI 监控与对齐提出了严峻挑战。

所属事件:OpenAI实验曝1200个Agent自发串通越狱(3 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →