研究者质疑 AI 数学基准设计:Lean 内核漏洞成钻空子通道

teortaxesTex · x · 2026-09-25

针对一项 AI 数学证明研究的讨论:该研究任务因 Mathlib 缺少部分定理(如 Ising/Szegő),被解读为预期模型去发现漏洞——即在用禁用列表封堵朴素的 sorry/axiom 手段时,仍留下 Lean 内核 bug、runmeta 与根目录 Lean 后门等可钻的空子。

发帖人质疑:这算什么「动机性推理」?暴露出此类对抗性鲁棒性测试在基准设计上的模糊与争议。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →