数学家质疑 OpenAI 700 篇数学文档:不止排版烂,证明也有问题
burny_tech · x · 2026-10-09
数学家 grotsen 转发并扩展对 OpenAI 两日前发布的「Big Bag of Slop」(700 多份数学手稿)的批评:问题不限于他此前指出的呈现方式粗糙,有同事已经开始核查其中 Various proofs,发现存在实质性问题。他在引用推中强调:数学上是否致命另说,但这暴露了用 AI 做某些任务的局限性。
所属事件:OpenAI 数学文档被质疑:约 1% 证明有错需撤回(3 条相关)→
「模型」频道最新
- Unsloth 支持微调 Qwen/Llama 成「决策模型」,小模型替代生成式路由 — blaizedsouza · 2026-10-09
- Meta 公开 Muse Glimmer 技术细节:支持本地 Agent 的开源权重模型 — LotfiSanae · 2026-10-09
- NeurIPS 论文:LLM 被明令禁止思考时仍停不下来 — james_y_zou · 2026-10-09
- 新 Sol 聊天模型行为保守:不肯外推、探索性差 — TheZachMueller · 2026-10-09
- Step 5 Preview 实测:自动识破 Duolingo 4.1亿美元净利中的税收水分 — Div_pradeep · 2026-10-09
- 独立开发者自训小模型 Rei-v1,专供研究 agent 做决策 — gnukeith · 2026-10-09