Swift-Qwen3.8-27B 推理 token 省 40%,Aider 实测速度近翻倍
returnity · reddit · 2026-09-16
UkisAI 发布 Swift-Qwen3.8-27B,针对 Qwen3.8-27B 的「过度思考」问题:团队识别出会触发过度推理的 reasoning-marker token,用 RL 惩罚这些 token,并借用了 BottleCap AI 的 ThinkingCap-Qwen3.6-27B 的迁移组件(该微调版此前已证明可省约 40% token 且性能持平)。
发帖人用 Aider 搭建编码评测独立验证:与原版 27B 相比,Swift 版 Pass1 30.8% vs 27.1%,Pass2 75.7% vs 77.6%,基本持平;但完成 token 从 12,547 降到 7,301(约 63%),单例耗时从 1,481 秒降到 750 秒——接近一半时间、三分之二 token 拿到同等成功率。解码越慢损失越大的特性让时间收益比 token 收益更夸张。对 27B 本地用户是显著提速。
「模型」频道最新
- OpenRouter 用户上周 OpenAI 消费反超 Anthropic,2.5 年来首次 — firstadopter · 2026-09-16
- DoorDash 等改用中国开源模型,闭源查询占比降至四分之一 — carlbfrey · 2026-09-16
- 阶跃星辰发布 StepAudio 3:5 款音频模型,ASR 达 1.7% WER — StepFun_ai · 2026-09-16
- 开源模型扛不住生产负载?Smaug Flash 称已修复卡死问题 — bindureddy · 2026-09-16
- ChatGPT 语音卡顿、Codex 报错,AGI 前的可靠性短板凸显 — koltregaskes · 2026-09-16
- 实测三大 AI 工作助手订行程:ChatGPT 与 Claude 查酒店双双翻车 — giffmana · 2026-09-16