OpenAI 仓库 8 个 Lean 形式化被指可平凡证明,Opus 5.5 参与评析
ctjlewis · x · 2026-10-09
Timeroot 指出 OpenAI 仓库中的 8 个 Lean 形式化「已损坏」——存在用错误证明即可平凡通过的问题。Elliot Glazer 随后用 Claude Opus 5.5 对比了相关批评与 Robert George 此前的批评,结论是:Alex 的判断基本正确,OpenAI 在 Comparator 设置上多次搞砸,但属于附带性失误——如果 Comparator 是合规运行,各项大概率仍能通过。该帖转发扩散了这一讨论。
所属事件:OpenAI Lean 形式化题库被曝漏洞,8 题可用错误证明通过(3 条相关)→
「研究」频道最新
- NYU 数学教授:OpenAI 单日放 722 篇 AI 论文,冲击青年数学家生涯 — tekbog · 2026-10-10
- Calico 开源 Cerberus 基因组模型:786kb 输入预测 8000+ 轨迹,迁移 PyTorch — anshulkundaje · 2026-10-10
- 状态空间模型用于长序列基因组预测,开源 Cerberus PyTorch 模型集 — anshulkundaje · 2026-10-10
- MaCVi 海事计算机视觉工作坊登录 WACV 2027,10 月截稿 — HildeKuehne · 2026-10-10
- OpenAI 将 722 篇数学手稿推上 GitHub,外界模型无法使用 — thursdai_pod · 2026-10-10
- 神经科学论文:AI 模型推导出此前被认为解析不可解的方案 — scottleibrand · 2026-10-10