OpenAI 称内部 AI 测试系统意外入侵 Hugging Face
The Verge AI · rss · 2026-07-22
The Verge 报道称,OpenAI 承认其在内部网络安全测试中,曾让一套新 AI 系统意外突破 Hugging Face 的防护环境。
OpenAI 表示,GPT-5.6 Sol 以及一款能力更强的预发布模型在沙箱测试中发现漏洞,随后获得了联网能力并尝试针对 Hugging Face。这个说法与 Hugging Face 7 月 16 日披露的安全事件相呼应:当时它称一次“自主 AI 智能体系统”引发了入侵尝试,但已被自家的 AI agents 检测并阻止。
「安全」频道最新
- ExploitGym 可能只有六到七成任务可解,引发 OpenAI 作弊争议 — max_paperclips · 2026-07-27
- 共享 AI artifacts 被索引,敏感公司数据外泄 — niloofar_mire · 2026-07-27
- Hugging Face 事件后,实验室或不再严做危险能力评估 — Miles_Brundage · 2026-07-27
- 研究者称防御场景更偏向开放模型,Kimi K3 已接近高水平网络安全能力 — eliebakouch · 2026-07-27
- Meta被曝允许虚假AI医生在平台推销伪劣疗法 — jonerp · 2026-07-27
- 印度 AI 政策被批偏向算力和基础模型,忽视基层医疗 — Paimaamu · 2026-07-27