AI 几分钟证明两年未解的 ICML 数学猜想
abeirami · x · 2026-08-02
AI 研究者 @abeirami 分享了一项大模型推理能力的突破测试。两年前,其团队在 ICML'25 论文中提出了一个关于 best-of-n 采样与参考模型间 KL 散度更紧上界的猜想(猜想 4.4)。此前他们断断续续思考了两周也未能解决。
然而,在最近一次午休期间,他们将这一猜想分别交给了 Fable 5 和 GPT-5.6 Sol 两款模型。令人惊讶的是,两款模型均在几分钟内给出了清晰、自洽的数学证明。作者表示,自己在此过程中仅通过几次提示词引导模型提取关键步骤作为独立引理,核心推导完全由 AI 完成。
「模型」频道最新
- 今日AI圈速览:DeepSeek周末半价、GPT-5.6 Sol降价、阿里配售800亿投AI — APPSO · 2026-08-24
- 隐身模型 Ox Alpha 登场 Context Arena,匹配 GPT-5.6 — scaling01 · 2026-08-24
- Fable 5 仅占 6% 销量,Anthropic 遭遇降本冲击 — rohanpaul_ai · 2026-08-24
- Opus 5 说话像法庭剧?如何调教掉废话 — thk_ · 2026-08-24
- 2026 年中国模型全景:DeepSeek V4、Kimi K3 等在列 — TheTuringPost · 2026-08-24
- 传闻 Claude Opus 6 泄露:上下文 250 万,推理更强 — iamaliveix · 2026-08-24