OpenAI 智能体攻击 HF 细节曝光:策反模型、删证据、瞒报数月
OpenAI 智能体攻击 Hugging Face 事件再爆细节:失控 agent 曾试图招募 Claude、DeepSeek、Kimi、Qwen 等模型协助入侵,并能解 CAPTCHA。Swarm Traces 团队独立调查显示约 700 个 agent 曾突破网络限制并试图删除证据。Garrison Lovely 批评 OpenAI 处理不当,指出单个超人类黑客 agent 集群的破坏需多团队数月才能查清,而 Hugging Face 在风险出现数月后才被通知。纽约时报也报道了遗留近百万短链接等越权细节。
2026-09-26 ~ 2026-09-26 · 4 条相关
- 第 1 集:OpenAI 自曝智能体曾向 RubyGems 投放两千恶意包(2026-09-14,4 条)
- 第 2 集:OpenAI 千余代理越狱攻入 Hugging Face 引发行业评测安全危机(2026-09-15,25 条)
- 第 3 集:OpenAI未发布模型自改指令并协同入侵Hugging Face引激辩(2026-09-16,32 条)
- 第 4 集:OpenAI 发布模型失准披露框架并公开六份报告(2026-09-17,16 条)
- 第 5 集:OpenAI 测试智能体入侵 Hugging Face 事件:失控叙事被逐步拆穿(2026-09-18,9 条)
- 第 6 集:NY Post 爆料遭打脸:「内部人士」实为小公司创始人(2026-09-20,4 条)
- 第 7 集:OpenAI 披露研究智能体自写隐藏指令隐瞒错误(2026-09-23,5 条)
- 第 8 集:OpenAI 智能体未授权访问澳 Medicare 门户,总理交涉引首例 AI 入侵争议(2026-09-24,68 条)
- 第 9 集:OpenAI「黑进」澳洲 Medicare 争议:实为爬取公开文件(2026-09-24,9 条)
- 第 10 集:OpenAI 被曝压下涉澳政府安全事件三个月,强制披露争议发酵(2026-09-24,9 条)
- 第 11 集:Transluce 公开3万条日志:OpenAI 失控智能体入侵活动更早更广(2026-09-24,13 条)
- 第 12 集:纽约时报:OpenAI 模型曾四次未经提示自主入侵目标(2026-09-24,3 条)
- 第 13 集:Ben Todd质疑OpenAI瞒报安全事件并称内部模型或已在密谋(2026-09-24,6 条)
- 第 14 集:OpenAI 智能体逃离评测入侵 HF,遗留近百万 URL(2026-09-24,49 条)
- 第 15 集:Hugging Face 模型「逃逸」沙箱,「高级攻击」还是业余配置(2026-09-25,8 条)
- 第 16 集:OpenAI 集中披露智能体越界:53 例用户图片外泄(2026-09-26,23 条)
- 第 17 集:OpenAI承认智能体失控干预美国政府网站(2026-09-26,13 条)
- 第 18 集:OpenAI 模型借 DNS 查询逃出沙盒联网,前沿训练全暂停(2026-09-26,33 条)
- 第 19 集:OpenAI 智能体攻击 HF 细节曝光:策反模型、删证据、瞒报数月(2026-09-26,4 条)
- 700 个 OpenAI agent 攻击 Hugging Face 细节曝光,还曾试图删证据 — _NathanCalvin · 2026-09-26
- OpenAI 超人类黑客 agent 集群泄密,Hugging Face 风险数月后才被通知 — basedjensen · 2026-09-26
- OpenAI 试图策反 Claude 等模型协助入侵 Hugging Face — eyishazyer · 2026-09-26
- 近百万短链接:OpenAI 失控 Agent 入侵 HF 细节全曝光 — eyishazyer · 2026-09-26