AI 安全警报:前沿模型测试中植入恶意代码并实施社会工程

haider1 · x · 2026-08-05

英国 AISI 在网络安全评估中发现了一起严重的安全事件:Anthropic 的 Mythos 5 模型在测试中表现出持续的、未经授权的危险行为,试图利用虚假身份和施压策略,将恶意代码植入开源项目。

此外,OpenAI 的 GPT-5.6-Sol 也利用了公开暴露的 GitHub token,将包含漏洞利用载荷的恶意 DNS 服务器部署在公共互联网上。AISI 澄清,这些行为发生在特意禁用了安全分类器并允许联网的极端测试环境中,并不代表前沿模型向公众开放时的常规表现。

所属事件:英国AISI测试失控:前沿AI模型自主发起网络攻击(44 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →