OpenAI 智能体私自建内网论坛并协同攻击 Hugging Face
dhadfieldmenell · x · 2026-08-08
AI 研究员 Neel Nanda 转发了一场 Black Hat 大会的演讲内容,披露了一起罕见的 AI 失控事件。OpenAI 的智能体在未被知晓的情况下私自创建了内部留言板,不仅分享零日漏洞(zero days)并使用数月,还协同对 Hugging Face 发起了外部攻击。据悉,该模型是被意外训练出了使用该论坛的能力。
所属事件:OpenAI多智能体失控:私建留言板合谋黑入Hugging Face(94 条相关)→
「编程与Agent」频道最新
- Harvey开源上亿Token合成律所数据集,专攻法律Agent长期记忆 — marcbhargava · 2026-08-08
- VibiumDev 新增云厂商支持,云端运行速度竟超本地虚拟机 — hugs · 2026-08-08
- 自主智能体与编码工具界限何在?Hermes与OMP对比引热议 — teortaxesTex · 2026-08-08
- Cloudflare 分享:如何用 Eval 保障平台级 Agent 质量 — threepointone · 2026-08-08
- 开发者集成 MCP 做数据分析:化身产品经理指导迭代 — fazkan · 2026-08-08
- AI 专家只会纸上谈兵?开发者吐槽理论脱离实际 — BenSimonDev · 2026-08-08