Qwen3.8-27B 默认 xhigh 推理:多花 8 倍 token 只换来噪音级提升
DerTomsn · reddit · 2026-09-10
作者发现 Qwen3.8-27B 的 chat template 默认 reasoningeffort=xhigh(三档最高),且该变量不在服务端报告中,用户很难察觉。他在单台 M5 Max、同一量化版本上实测三档:
- low 与 medium 实际相同:token 几乎一样(4984 vs 4792),模型会执行 xhigh 的「仔细思考」指令,却忽略 low 的「简短思考」指令——旋钮实际只有两档
- xhigh 花费 8 倍 token、11 倍耗时(869s vs 77s),中位数只高约半分,完全在运行间噪声内(medium 四次跑分 64.7–84.2)
- xhigh 真正改变的是方差与风格:跑出最高分也跑出最低分,且预算花在了标题卡、按键说明、音效开关等「更好看」而非「更好」上
作者附了思考预算实验:12k 上限可把耗时砍半且不截断输出。成本数据可靠,质量结论建议作为方向自行验证。
「编程与Agent」频道最新
- 实测:让 Astra 直接操作软件界面,效果远超内置 agent — brandon_galang · 2026-09-10
- Agent 单 PR 成本降至 $30,团队称可压到 $10 以下 — vikvang1 · 2026-09-10
- 开发者展示 Codex Remote 双开玩法,引圈内围观 — Dimillian · 2026-09-10
- 吴恩达团队发布 AI 工程技能地图第三支柱:驾驭编码 Agent 核心技能 — DeepLearningAI · 2026-09-10
- 同款 Agent 还会自动分析项目并提示需要配置的 secrets,但 UX 很难做对 — lucasmeijer · 2026-09-10
- 新用户携项目入驻时,Agent 自动生成最优 Dockerfile 优化启动时间 — lucasmeijer · 2026-09-10