开发者微调 Qwen3.8-27B-pi 修复推理分级乱序
独立开发者 bytkim 在租用 GPU 上微调出 Qwen3.8-27B-pi,专门面向 Pi 编码 agent 场景。起因是他发现基座 Qwen3.8-27B 的 reasoning effort 分级失效,出现 low 档推理效果反超 medium 的乱序问题。经过微调后模型修复了这一缺陷,并节省约 41% 的 token 消耗。
2026-10-01 ~ 2026-10-01 · 2 条相关
- 个人微调 Qwen3.8-27B:修复 low 推理反超 medium 的乱序问题 — victormustar · 2026-10-01
- 个人微调 Qwen3.8-27B-pi:修复推理力度乱序,省 41% token — victormustar · 2026-10-01