测试前沿模型数学能力:证明定理比找反例难得多
doodlestein · x · 2026-08-01
作者在测试前沿模型(frontier)的数学研究能力时感叹,寻找反例固然厉害,但给出严谨的长证明来将猜想变为定理要难得多,也更具实用价值。他自嘲可能选了一个过于困难的问题来测试模型的极限。
所属事件:实测前沿AI数学能力:找反例惊艳,写长证明遇阻(2 条相关)→
「模型」频道最新
- 开发者实测:Kimi K3主观体验超越其他前沿模型 — andrewgwils · 2026-08-01
- OpenAI大降价:GPT-5.6 Luna输入价格暴降80% — gabrielchua · 2026-08-01
- AI视频新图灵测试被攻破,海螺AI成功在黑板上写字 — venturetwins · 2026-08-01
- 外界看衰Gemini Pro预期,但看好Flash版本表现 — AccBalanced · 2026-08-01
- Simon Willerson:DeepSeek新模型性价比极高,处于帕累托前沿 — AccBalanced · 2026-08-01
- Simon Willerson实测:调高推理强度,DeepSeek新模型画图改善 — AccBalanced · 2026-08-01