论文:开头加两个 token,基座模型 MATH-500 从 42% 升到 78%

arankomatsuzaki · x · 2026-10-06

Sophie L. Wang、Amil Dravid 等人(含 Alexei Efros)的论文《Base Models Can Reason By Taking a Cue From Training Data》发现,基座模型的推理能力可以在不训练的情况下被「唤醒」:

所属事件:研究发现开头token线索可激发基座模型推理媲美RL(5 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →