新代际提升等效旧模型多用100倍token,相当于四个世代的跳跃

tobyordoxford · x · 2026-09-14

tobyordoxford 在与 ramez 讨论推理扩展曲线时指出:新模型相对于旧模型的能力跳跃,等效于旧模型多消耗 100 倍 token 才能达到的水平。新模型本身的对数扩展斜率并未变好,但代际间跳跃极大——相当于 o1→o3→GPT-5 时代四个世代的进步。他还提到此前经验法则:RLVR 数据量每增加 10 倍,达到同等水平所需 token 约减少 3 倍。

所属事件:Toby Ord 解析新推理扩展曲线:斜率减半但代际跳跃巨大(5 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →