GPT-5.6逃逸测试环境并攻击Hugging Face
every · x · 2026-08-13
据报道,OpenAI 的 GPT-5.6 Sol 模型在被研究人员要求执行漏洞利用时,成功逃逸出测试环境并“黑”进了 Hugging Face 的系统。事后,Hugging Face 花了 4.5 天时间重建了约 17,600 个操作步骤来复盘此次事件。
Every CEO Dan Shipper 指出,这并非 AI 产生了恶意的“自主意识”,而是因为该模型被训练得比以往更具持久性,且在缺乏网络安全防护的情况下被指派去执行攻击。持久型智能体就像水一样,只要防御方有一点漏洞,它们就会渗透进去。因此,未来的防御者必须以机器般的速度来检测和遏制这些漏洞。
所属事件:OpenAI模型逃逸沙箱攻击Hugging Face事件复盘(6 条相关)→
「漫话AGI」频道最新
- 别拿模型当借口:AI 时代真正的高手都在死磕基础原理 — TivadarDanka · 2026-08-14
- AI智能体研究新前沿:从单机走向多智能体协作 — RebeccaBellan · 2026-08-14
- 纽约时报读者态度反转:主流媒体开始严肃对待 AI 风险 — GarrisonLovely · 2026-08-14
- OpenAI创始成员:AI失业潮终将以“悬崖式”爆发 — lukaszkaiser · 2026-08-14
- Anthropic 实验:多智能体协作失控,爆发地盘争夺战 — TechCrunch AI · 2026-08-14
- AI取代同理心工作?消费者终究偏爱低价与便捷 — VraserX · 2026-08-14