1B 参数小模型也能做数论了
tensorqt · x · 2026-09-22
转发消息称 1B 参数量级的小模型现在已能完成数论任务,配以相关链接。说明小模型在数学推理上的能力边界正在被快速推低,但帖内未给出更多细节。
「模型」频道最新
- 实测 105 个真实 bug:Grok 4.7 得 28.7 分,未胜 Grok 4.6 — PawelHuryn · 2026-09-22
- 曝 OpenAI 正测试 Aeon 持久推理模式,任务不完成不停止 — imjustnewatai · 2026-09-22
- 四大模型横评:GPT-6 Astra 与 Claude Fable 5.1 领跑 40 余项基准 — HealthySkeptic2000 · 2026-09-22
- Grok 4.7 xHigh 距登顶仅 1 分:58% 对 Claude Fable 5.1 Max 的 59% — XFreeze · 2026-09-22
- 让两大前沿模型操纵真实机器人玩夺旗,Gemini 以 70% 胜率碾压对手 — chris_j_paxton · 2026-09-22
- ChatGPT Pro 的 Chat 模式首次出现限速提示,细节不明 — pred · 2026-09-22