让模型自己调 thinking 档位:自适应 reasoning effort 初试提速明显
HeDo88TH · reddit · 2026-09-06
针对近期 Qwen 3.8 27B thinking levels 的争论,作者提出与其手动选 thinking 档位,不如改造 harness 让 LLM 自己决定何时升降推理力度。
做法:系统根据成功/失败 streak 在 low 与 xhigh 之间自动调节,日志显示规则如——「连续成功→降到 low」「有意义的失败→升到 medium」「机械性步骤→降档」「进入 RECOVER/DEBUG 阶段→升档」。作者称初步观感是解题速度大幅提升,但还没有可靠的质量评估数据。
他也在征求同类实践者,并纠结如何量化质量(比如跑 GPQA Diamond 前后对比)。
所属事件:开发者实测自适应推理强度:让模型自己调 thinking 档位(2 条相关)→
「编程与Agent」频道最新
- NEAR AI Lean agent 全解 Putnam Bench,成本仅为次便宜方案的 1/250 — lukaszkaiser · 2026-09-06
- 21 份 agent 简报自相矛盾,canonical context 成多智能体痛点 — Ok_Confection_3847 · 2026-09-06
- 从大脑到双手:被引推文拆解 Claude Agent 三层技术栈 — anirbanbandyo · 2026-09-06
- 用苹果免费模型在 iOS 上搭一个本地 ChatGPT:文本+语音全离线 — amos_gyamfi · 2026-09-06
- Plus 用户多模型分工工作流:ASTRA 只当架构师省额度 — KhaaliSeDin · 2026-09-06
- MCP 推荐榜单都回避的核心问题:你到底给了 agent 多大破坏半径 — aineemaniee · 2026-09-06