OpenAI Lean 形式化题库曝漏洞:8 题可用错误证明绕过

gklambauer · x · 2026-10-09

博主 Timeroot 指出,OpenAI 的 Lean 形式化验证仓库中至少 8 个 comparator 挑战题存在可被破解的缺陷,并发布博客详细说明。

核心问题在于:许多本应固定的定义被错误地列在 . 的 definitionnames 字段里,意味着这些定义可以被自由改写而不影响 Comparator 的接受判定。作者以 EuclideanFiveColor.lean 为例,把 ProperColoring 定义改成 False 后,定理退化为平凡可证,仍能通过验证。

受影响的题目包括 Bernier、LogspaceEquality(即 L=RL=BPL)、KServer、Naimark、OccupiedOverlap、Rokhlin、SpinAngle 等。作者指出这比表面更危险:部分题目文件较短尚可人工核对,但另一些案例中定义可被篡改且不易察觉。据作者所知此前无人公开讨论过该问题。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →