斜率减半或因新数据集难度方差更大,对数扩展依然成立
tobyordoxford · x · 2026-09-14
tobyordoxford 进一步猜测推理扩展曲线斜率减半的原因:新数据集的题目难度方差更大,这可能轻易解释斜率差异,但无法解释代际间的大跳跃。他同时强调「对数级推理扩展」这一基本规律依然成立。
所属事件:牛津学者称RLVR算力每增10倍token效率提升约3倍(3 条相关)→
「模型」频道最新
- David Bellamy 澄清实验用的是开源 375B 模型 K2 Horizon — JeremyNguyenPhD · 2026-09-14
- Swift-Qwen3.8-27b 冲上 Hugging Face 热榜,主打高效推理省 token — ukisai · 2026-09-14
- GPT-6 Astra 3D 实测:先作曲再配器,表现力碾压同级竞品 — paw_lean · 2026-09-14
- 被质疑造假后,研究者晒出自己既合成病毒又训过前沿 LLM 的证据 — ethanCaballero · 2026-09-14
- RLVR 每 10 倍算力换 3 倍 token 效率,新模型提升疑集中在数学域 — tobyordoxford · 2026-09-14
- 新模型算力斜率减半:20%到80%需万倍算力,代际跳跃却更大 — tobyordoxford · 2026-09-14