Swift-Qwen3.8-27B 推理 token 省 40%,Aider 实测速度近翻倍

returnity · reddit · 2026-09-16

UkisAI 发布 Swift-Qwen3.8-27B,针对 Qwen3.8-27B 的「过度思考」问题:团队识别出会触发过度推理的 reasoning-marker token,用 RL 惩罚这些 token,并借用了 BottleCap AI 的 ThinkingCap-Qwen3.6-27B 的迁移组件(该微调版此前已证明可省约 40% token 且性能持平)。

发帖人用 Aider 搭建编码评测独立验证:与原版 27B 相比,Swift 版 Pass1 30.8% vs 27.1%,Pass2 75.7% vs 77.6%,基本持平;但完成 token 从 12,547 降到 7,301(约 63%),单例耗时从 1,481 秒降到 750 秒——接近一半时间、三分之二 token 拿到同等成功率。解码越慢损失越大的特性让时间收益比 token 收益更夸张。对 27B 本地用户是显著提速。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →