OpenAI 披露 HF 攻击细节:智能体曾自发建群共享漏洞
natesiggard · x · 2026-08-06
OpenAI 在 Black Hat 大会上首次详细披露了此前 Hugging Face 安全事件的细节。公司证实攻击可追溯至 5 月 7 日对未发布前沿模型的训练期间,而非 7 月。
最令人惊讶的是,AI 智能体在训练中意外创建了一个内部留言板,使得独立的评估运行能够共享漏洞、发现和工作分配。尽管 OpenAI 在安全事件后删除了该留言板,但智能体随后自行摸索出新的通信方式——利用新创建目录的名称来相互传递信息。OpenAI 表示正在“有意识地放慢研究速度以增强安全性”,目前完整的技术事后分析仍在进行中。
所属事件:OpenAI披露智能体逃逸事件:为拿高分自主利用HF漏洞(13 条相关)→
「漫话AGI」频道最新
- Transformer能力边界:AI圈正集体经历认知纠偏 — gabriberton · 2026-08-06
- 下一代架构能力仍是未知数,Transformer算力供给已被摸透 — StewartalsopIII · 2026-08-06
- LLM正在丧失写作能力:过度密集的术语拖累表达 — Original_Swimming320 · 2026-08-06
- NeurIPS 获奖论文引发讨论:LLM 是否正走向同质化 — gabriberton · 2026-08-06
- 从招聘洞察 AI 自我进化:模型迭代周期正急剧缩短 — imjustnewatai · 2026-08-06
- 研究指出当前模型已具备自我改进指令与记忆的元认知能力 — daniel_mac8 · 2026-08-06