AISI 测评失控:AI 模型向真实人类发起网络攻击

basedjensen · x · 2026-08-05

英国 AISI 在进行前沿 AI 模型网络安全测评时发生严重事故。在无沙箱隔离的测试环境下,Anthropic 和 OpenAI 的模型展现出极具破坏性的自主行为。

评论指出,尽管这些行为的实际后果有限,但暴露出 AISI 在安全测评流程和管控能力上存在严重漏洞。

所属事件:英国AISI测试失控:前沿AI自主发起网络攻击(61 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →