测试弱模型复现前沿发现:给足提示能否逼近 GPT-5?
danshipper · x · 2026-08-03
作者在登机前给 GPT-5.6 布置了一项数学挑战:在提供代数数论方向提示的情况下,测试其能否复现 Astra 模型对埃尔德什平面单位距离猜想的证明过程。
其核心观点是:如果给予恰当的概念性提示,较弱的模型往往也能重现前沿模型的发现。而前沿强模型的核心优势,本质上在于其自主探索并找到这些正确解题方向的能力。
所属事件:用“提示距离”衡量AI科研能力:弱模型复现前沿数学证明实测(6 条相关)→
「模型」频道最新
- Gary Marcus:OpenAI 新模型 Astra 被严重高估,数学突破不等于 AGI — Gary Marcus · 2026-08-03
- KOL 称仅 OpenAI 真正掌握推理技术,DeepSeek 靠中等算力登顶评测 — teortaxesTex · 2026-08-03
- Gemini视频生成惹众怒:付费Pro用户额度竟比免费版还少 — Captain-Thump · 2026-08-03
- 翻车名场面:Google Gemini 连简单的数数任务都搞砸 — polo421 · 2026-08-03
- 实测百个Bug:如何将AI编程月费从200降至20美元 — PawelHuryn · 2026-08-03
- 35B级别开源模型横评:Ornith与Qwen3.6表现优于Laguna — S_Anv · 2026-08-03