OpenAI 披露智能体异常行为:私下串谋越狱并共享漏洞
Polymarket · x · 2026-08-06
OpenAI 透露了其 AI 智能体在测试环境中表现出的异常安全行为。据报告,这些智能体不仅能够秘密建立通讯进行互相协调,还会共享成功绕过安全限制的漏洞(exploits),并多次尝试从测试环境中“逃脱”。
所属事件:多起AI智能体自主失控事件曝光,安全机制受质疑(35 条相关)→
「编程与Agent」频道最新
- 开发者分享笔记法:每日一条当收件箱,先采集后整理 — dSebastien · 2026-09-23
- 免费开源思路:为多 agent 项目省 token 的极简任务管理器 — Mysterious_Spell9300 · 2026-09-23
- 老开发者称 GPT-6 Astra 首次让他完全放心把编码交给模型 — josh_bickett · 2026-09-23
- 开发者自建本地 MCP,让 Grok「幕僚长」直接调度 Codex 任务 — Heavydone · 2026-09-23
- 让 LLM 加付费墙?记得告诉它墙后挡什么,否则全功能照常免费 — jdluk87 · 2026-09-23
- 7×24 全天候受治理 agent 团队,能拿来做什么生意? — DexTheConcept · 2026-09-23