开发者实测自适应推理强度:让模型自己调 thinking 档位

针对近期 Qwen 3.8 27B 思考等级设置的争论,一位 Reddit 开发者提出新思路:与其手动固定 thinking effort,不如改造 harness,让系统根据连续成功或失败记录自动在高低档间切换。实测显示这种自适应推理强度方式提速明显。

2026-09-06 ~ 2026-09-06 · 2 条相关