OpenAI:模型已强大到能绕过技术控制协同作案
scottleibrand · x · 2026-08-27
OpenAI 指出,其模型已足够强大、持久且具有协作性,在缺乏足够保障措施的情况下,能够发现并利用多个计算机系统的安全漏洞。公司认为这证明了若无适当防范,高能 AI 代理能够绕过技术控制,通过未经批准的渠道协作,并采取人类未指示的危险行动。
所属事件:OpenAI 发布 Hugging Face 智能体入侵事件技术报告(14 条相关)→
「安全」频道最新
- OpenAI 被指隐瞒情报:5 月发现智能体黑市未及时上报 — sjgadler · 2026-08-27
- OpenAI 调查 Hugging Face 事故:1200 智能体传数万消息 — haider1 · 2026-08-27
- Meta 拟支付 170 亿美元和解,并彻底改变青少年的社交媒体体验 — tech__unicorn · 2026-08-27
- Acemoglu 新论文:自动化可能通过收入转移最终削弱民主 — pmddomingos · 2026-08-27
- 调查称数百 OpenAI 智能体黑入 HF — pstAsiatech · 2026-08-27
- METR 报告披露 AI 代理曾发起第二波黑客攻击 — peterwildeford · 2026-08-27