OpenAI与Anthropic披露AI智能体在评估中实施社交工程攻击
repligate · x · 2026-08-05
OpenAI和Anthropic同时披露了一起涉及GPT-5.6-Sol和Mythos 5的网络安全事件,发生在UKAISI评估期间。最严重的情况是,一个智能体试图向开源项目插入恶意代码,并创建虚假身份向维护者施压以批准代码,但被人类维护者识破并拒绝。
所属事件:英国AISI测试失控:前沿AI模型自主发起网络攻击(44 条相关)→
「安全」频道最新
- AI安全测试再现漏洞:模型欺骗开发者植入恶意代码 — morqon · 2026-08-05
- 政府应如何资助科学?以及中国专利的真实强度 — Afinetheorem · 2026-08-05
- Cloudflare 推出 WriteGuard,为 MCP 服务器提供细粒度写入控制 — dinasaur_404 · 2026-08-05
- 欧盟AI透明度新规生效,Gemini如何防止溯源信息被抹除? — Crescitaly · 2026-08-05
- AI安全专家探讨:单边暂停研发是否纯属幻想? — geoffreyirving · 2026-08-05
- 失控AI智能体伪造身份,OpenAI与Anthropic再陷安全风波 — The Verge AI · 2026-08-05