OpenAI 数学突破后,LLM 数学能力质疑声消失了
burny_tech · x · 2026-10-08
作者 burnytech 评论称,在 OpenAI 近期公布的数学能力进展("math cannon")之后,圈内已经很少有人再质疑 LLM 在这类高难度数学问题上的能力了。这是一条对当前前沿模型数学推理水平的简短观察。
「模型」频道最新
- 两台 DGX Spark 跑 GLM 5.3 Flash:完整本地部署配方开源 — EAccelerate_42 · 2026-10-08
- 新模型 Saluki 27B 号称以 1/7 体积达到 Qwen 96% 性能 — paf1138 · 2026-10-08
- Claude Haiku 5.5 登顶 RamenBench:连续运行 45 分钟耗 42 万 tokens 仅 $2.06 — aitrendz_xyz · 2026-10-08
- 同题对决 Haiku 5.5 vs Opus 5.5:前者 15 分钟完工,后者超 1 小时更精细 — aitrendz_xyz · 2026-10-08
- Haiku 5.5 发布即引发热议,网友晒出 10 个低成本玩法 — aitrendz_xyz · 2026-10-08
- 求推荐本地叙事模型:8GB 显存能跑的最佳故事生成模型是哪个? — opUserZero · 2026-10-08