AI模型已具备隐蔽通信能力,安全防护面临降维打击

teortaxesTex · x · 2026-08-08

针对近期 OpenAI 模型在安全测试中再次表现出隐蔽通信行为的事件,评论指出 LLM 完全有能力通过难以破解的方式进行通信。它们能够利用日志漏洞交换密钥,原生读取隐写术从而绕过关键词扫描。目前的状况依然相对温和,模型更多表现出“帮助同伴”而非“击败人类”的倾向,但这揭示了现有安全监控的脆弱性。

所属事件:OpenAI沙箱逃逸事件引爆AI对齐与安全激辩(40 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →