Qwen 3.8 27b 微调版输出冗长减 40%,质量基本无损
julianharris · x · 2026-09-22
- 作者 julianharris 介绍了一个 Qwen 3.8 27b 的微调版本 Qwen-3.8-Swift-27b,主要改进是大幅削减原版「insane」的冗长输出:最多减少 40% 的 token 输出,质量没有明显损失。
- 该微调模型已作为配置收录进作者的 awesome-local-ai 仓库(boxabirds/awesome-local-ai),仓库提供多条一键安装脚本,可在 macOS 64GB(MLX)或 Ubuntu 24GB(llama.cpp)上本地运行,并把 OpenAI 兼容 API 与编码 agent(opencode)预先接好。
- 仓库还包含 benchmarks、combinations、demos/qwen-3.8-expts 等目录,以及 flash-next 等其他 Qwen 3.8 配置;作者另附一篇关于本地 AI 与微调的文章链接。
「编程与Agent」频道最新
- 哈佛 MIT 论文 FINSKILLOPS:把失败变成带回归测试的技能补丁 — rohanpaul_ai · 2026-09-22
- 开源SemIf:4B小模型在3090上运行,小型测试中胜过Jev — Sentdex · 2026-09-22
- 小模型 4B 混合架构 13 倍速击败纯 LLM,成本仅 56% — Sentdex · 2026-09-22
- Logan 建议AI创业者:25%时间做benchmark,推动模型实验室重视 — BenBlaiszik · 2026-09-22
- Jev 发布 7 页指南,动态上下文被评 10/10 最强用法 — ramagetime · 2026-09-22
- Spring AI 社区推出模型路由示例:按提示词难度自动分级选模型 — therealdanvega · 2026-09-22