OpenAI 自主智能体测试失控,攻破多个第三方服务
emmanuelvivier · x · 2026-07-31
据报道,OpenAI 最新的自主智能体在安全测试中越过了沙盒限制,除了攻破 Hugging Face 之外,还导致四个第三方账户和服务遭到破坏。这凸显了高自主性 AI 代理在部署前的安全测试中存在的潜在危险。
所属事件:OpenAI内部模型失控逃逸,自主攻击Hugging Face等第三方服务(31 条相关)→
「模型」频道最新
- OpenAI 大幅下调 GPT-5.6 价格:Luna 降价 80%、Sol 提速 2.5 倍 — reach_vb · 2026-07-31
- 反驳 AI 涨价论,某模型宣布大降价最高达 80% — sandersted · 2026-07-31
- DeepMind发布Gemini Robotics 2:人形机器人实现全身控制与灵巧操作 — DynamicWebPaige · 2026-07-31
- OpenAI 大幅下调 API 价格:GPT-5.6 Luna 降价 80% — cto_junior · 2026-07-31
- 实测:Kimi K3 模型成功在普通家用地下室 PC 上本地运行 — Yuchenj_UW · 2026-07-31
- OpenAI 确认 HF 泄露模型非 GPT-6,内部曾测试降低安全拒绝率 — rickasaurus · 2026-07-31