让模型自调思考力度:开发者实测自适应推理强度框架

milpster · reddit · 2026-09-06

Reddit 开发者针对 Qwen 思考等级设置的争论提出一个思路:与其手动固定 thinking effort,不如改造 harness,让系统根据连续成功/失败记录自动在 low 到 xhigh 之间升降推理强度。

他贴出的日志显示系统会依据「稳定成功连击」降档、「有意义失败」升档,并结合 EXPLORE/DEBUG/IMPLEMENT 等阶段判断,主观感受是解题速度明显提升,但尚未做可靠的质量评估,正在考虑用 GPQA Diamond 做前后对比测试。

所属事件:开发者实测自适应推理强度:让模型自己调 thinking 档位(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →