博主串联 R1 长思维链旧事:给足思考预算,小模型解题能力暴涨
karminski3 · x · 2026-09-14
博主 karminski3 回顾 DeepSeek R1 论文中的关键发现:模型长思考时 Pass@1 从 71.0% 飙升至 86.7%,R1 生成的长思维链被蒸馏到 Qwen-1.5B/7B/14B 小模型后,推理时给足思考预算,解题能力随思考长度正相关暴涨。他借此反驳「推理开 max 并不更优」的说法,并提醒:去年 ollama 上把 deepseek-r1-distilled-qwen-7b 当「DeepSeek」装到大家电脑上的那波操作,正是同一段历史,怎么这么快就被遗忘了。
所属事件:DeepSeek 思考强度设置是否影响性能引争论(3 条相关)→
「模型」频道最新
- GPT-6 实测视频:独立做出 Fall Guys 风格小游戏 — Matthew Berman · 2026-09-14
- 网友实测与 DeepSeek 玩 GeoGuessr:VLM 定位能力相当不错 — PMinervini · 2026-09-14
- 评论人称 Anthropic 炼书训练致百万书籍原文失传 — StewartalsopIII · 2026-09-14
- 书生发布 397B 开源模型 Intern-S2,多模态与 Agent 能力加持,vLLM 零日支持 — Nunki08 · 2026-09-14
- 圈内人实测:DeepSeek V4.1 基准偏低但速度快 4 倍 — teortaxesTex · 2026-09-14
- 4GB 显存求推荐:擅长写作的小型本地 LLM 怎么选 — Mysterious-Comment94 · 2026-09-14