新代际提升等效旧模型多用100倍token,相当于四个世代的跳跃
tobyordoxford · x · 2026-09-14
tobyordoxford 在与 ramez 讨论推理扩展曲线时指出:新模型相对于旧模型的能力跳跃,等效于旧模型多消耗 100 倍 token 才能达到的水平。新模型本身的对数扩展斜率并未变好,但代际间跳跃极大——相当于 o1→o3→GPT-5 时代四个世代的进步。他还提到此前经验法则:RLVR 数据量每增加 10 倍,达到同等水平所需 token 约减少 3 倍。
所属事件:Toby Ord 解析新推理扩展曲线:斜率减半但代际跳跃巨大(5 条相关)→
「模型」频道最新
- 评论人称 Anthropic 炼书训练致百万书籍原文失传 — StewartalsopIII · 2026-09-14
- 书生发布 397B 开源模型 Intern-S2,多模态与 Agent 能力加持,vLLM 零日支持 — Nunki08 · 2026-09-14
- 圈内人实测:DeepSeek V4.1 基准偏低但速度快 4 倍 — teortaxesTex · 2026-09-14
- 4GB 显存求推荐:擅长写作的小型本地 LLM 怎么选 — Mysterious-Comment94 · 2026-09-14
- X 网友称传阅的 Astra/Fable 参数远小于 10 万亿,模型规模已难对应能力 — teortaxesTex · 2026-09-14
- 记者实测:免费 ChatGPT 花 13 分钟破解十年悬而未决的骰子难题 — Chris_Armstrong · 2026-09-14