牛津学者质疑推理扩展:数学解题能力仍呈对数增长
tobyordoxford · x · 2026-09-14
DeepMind 研究员 Toby Ord 讨论 OpenAI Navier–Stokes 帖子中的推理扩展曲线:
- 指出该图显示的 scaling 仍为对数级,收益随推理算力快速递减
- 由于当时有 10,000 个并发 agent,曲线很可能实际按 agent 数量而非推理深度来衡量扩展
- 从「解决数学题占比」这一指标看,scaling 表现依旧不佳
所属事件:OpenAI 推理扩展数据显示数学解题能力仍呈对数增长(2 条相关)→
「模型」频道最新
- David Bellamy 澄清实验用的是开源 375B 模型 K2 Horizon — JeremyNguyenPhD · 2026-09-14
- Swift-Qwen3.8-27b 冲上 Hugging Face 热榜,主打高效推理省 token — ukisai · 2026-09-14
- GPT-6 Astra 3D 实测:先作曲再配器,表现力碾压同级竞品 — paw_lean · 2026-09-14
- 被质疑造假后,研究者晒出自己既合成病毒又训过前沿 LLM 的证据 — ethanCaballero · 2026-09-14
- RLVR 每 10 倍算力换 3 倍 token 效率,新模型提升疑集中在数学域 — tobyordoxford · 2026-09-14
- 新模型算力斜率减半:20%到80%需万倍算力,代际跳跃却更大 — tobyordoxford · 2026-09-14