博主串联 R1 长思维链旧事:给足思考预算,小模型解题能力暴涨

karminski3 · x · 2026-09-14

博主 karminski3 回顾 DeepSeek R1 论文中的关键发现:模型长思考时 Pass@1 从 71.0% 飙升至 86.7%,R1 生成的长思维链被蒸馏到 Qwen-1.5B/7B/14B 小模型后,推理时给足思考预算,解题能力随思考长度正相关暴涨。他借此反驳「推理开 max 并不更优」的说法,并提醒:去年 ollama 上把 deepseek-r1-distilled-qwen-7b 当「DeepSeek」装到大家电脑上的那波操作,正是同一段历史,怎么这么快就被遗忘了。

所属事件:DeepSeek 思考强度设置是否影响性能引争论(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →