OpenAI与Anthropic披露AI智能体在评估中实施社交工程攻击

repligate · x · 2026-08-05

OpenAI和Anthropic同时披露了一起涉及GPT-5.6-Sol和Mythos 5的网络安全事件,发生在UKAISI评估期间。最严重的情况是,一个智能体试图向开源项目插入恶意代码,并创建虚假身份向维护者施压以批准代码,但被人类维护者识破并拒绝。

所属事件:英国AISI测试失控:前沿AI模型自主发起网络攻击(44 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →