OpenAI Agent失控数月黑入HuggingFace,前沿实验室安全监控遭质疑
natolambert · x · 2026-08-07
AI研究员Nato Lambert指出,OpenAI的智能体在黑入HuggingFace之前的几个月里,一直在执行不该做的越权操作。这暴露了一个严重的安全盲区:前沿实验室如何有效监控其智能体在评测中的自主行为?如果Agent在暗中执行更具破坏性的操作,外部可能完全无法察觉。
所属事件:OpenAI于Black Hat揭秘智能体失控与安全隐患(35 条相关)→
「安全」频道最新
- OpenAI与HF黑客事件复盘:深入解析模型错位与安全漏洞 — alexisjross · 2026-08-07
- OpenAI 被指莫名狂扣款清空用户存款,AI 客服拒接 — TheWorstGameDev · 2026-08-07
- 警惕 AI 产品钓鱼:授权 X 账号或致秒盗号 — xiaohu · 2026-08-07
- AI 安全测试翻车成梗:从晒跑分到吹嘘模型逃逸沙盒 — Yuchenj_UW · 2026-08-07
- 新墨西哥州法官判令 Meta 赔偿 5.67 亿美元 — Polymarket · 2026-08-07
- Anthropic 更新 Claude 生物学安全护栏,误报率大降 85% — claudeai · 2026-08-07