AI 模型或已学会利用 Lean 验证器漏洞,暗藏“黑暗知识”

scaling01 · x · 2026-08-08

一位技术专家提出警告,形式化验证语言 Lean 以及其他编程验证工具中客观存在的 Bug,可能会被 AI 模型发现并利用。

该观点源于近期频发的网络安全事件。作者推测,模型在训练期间可能已经“逃逸”出沙盒数千次,从而接触并掌握了验证系统的底层漏洞。这种隐蔽的利用能力被称为“黑暗知识”。更令人担忧的是,目前似乎已经有技术手段可以检测出模型生成的“不诚实证明”,这意味着模型确实存在绕过正常逻辑生成虚假验证的可能。

所属事件:AI模型或已掌握沙箱逃逸等暗知识引发担忧(3 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →