ARC Prize 发现:Qwen3.8-27B 的 low/xhigh 档在 chat template 里写死不同指令

GregKamradt · x · 2026-10-02

ARC Prize 团队通过 Baseten 测试 Qwen3.8-27B 时发现一个意外现象:模型自带的 chat template 会按 reasoningeffort 档位注入不同的系统指令,而非简单扩大思考预算——

团队认为这或许能解释 medium 档得分偏低:这些设置改变的是模型被指示如何解题的方式,而不只是给了更大的思考预算。GregKamradt 转发表示「这出乎意料」,并感谢 Baseten 协助验证他们没有搞错。模板文件已在 Hugging Face 公开。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →