数学家验证 GPT Pro:零计算错误,但证明表述极差
josh_wills · x · 2026-08-04
数学家 Dimitris Papail 在使用 GPT Pro 验证特定数学定理时分享了他的观察:
- 准确性极高:在目前的验证过程中没有发现任何数学计算错误。当 GPT Pro 给出肯定结论时,其可信度甚至超过了研究者本人使用 Lean 定理证明器的结果。
- 表述体验糟糕:模型生成的证明过程可读性极差。它倾向于使用极度复杂的变量名嵌套(如将范数比值重命名为希腊字母),导致阅读者需要耗费大量精力追踪变量重命名。
- 逻辑组织混乱:所需的技术引理出现顺序非常随机,缺乏人类数学论述中层层递进的逻辑结构。
尽管体验令人疲惫,但他依然惊叹于模型能在不到一小时内解决人类数学家长期未能攻克的难题。
「模型」频道最新
- Qwen3.8-Max 在 Vision Arena 视觉榜单排第 2,仅差 13 分 — arena · 2026-08-04
- Polymarket 预计两周内发布新 Gemini Pro,概率达 82% — Polymarket · 2026-08-04
- 大家在找能准确描述露骨图片的“无审查”VLM — TekeshiX · 2026-08-04
- Claude 使用量监控疑似异常,两轮对话就显示 99% — dreamwieber · 2026-08-04
- 一张图片把多个 AI 模型放在同一画面里 — wavefnx · 2026-08-04
- Databricks 称 Kimi K3 推理速度已达 239 tokens/s — Yuchenj_UW · 2026-08-04