数学家实测最新推理模型:自研难题 Sol 5.6 与 Fable 5.1 均无解
burny_tech · x · 2026-09-07
一位研究者反驳「数学已死」论,指出被忽视的另一半事实:大量常规数学问题 AI 依然解不了。他称在自己真正思考过的一些问题上,尝试了 Sol 5.6 和 Fable 5.1,两个模型一个都解不出来。这与动辄「模型刷爆 IMO」的叙事形成反差,提醒人们前沿模型在真实研究级数学上的能力边界仍然明显。
「模型」频道最新
- 146 个模型变体创意写作评测:Opus、Fable、Kimi K3 登顶 — zainhas · 2026-09-07
- 拆解 Claude 写作腔:拟人化主语与「以否定立论」两大套路 — Sauers_ · 2026-09-07
- 生产环境跑 11.5 万条视频后,团队总结 Gemini 视频理解四大坑 — TheMoonMidas · 2026-09-07
- TheZvi 实测:Astra 未通过 EditorBench,与 Sol 翻车原因相同 — TheZvi · 2026-09-07
- Astra 原生异步工具调用好用,但爱把提问混进推理文本里 — nrehiew_ · 2026-09-07
- 21 小时长跑后翻车:用户细数 Astra 建数据集的连串低级错误 — ivan_bezdomny · 2026-09-07