Qwen3.8 蒸馏版 9B/4B/2B 发布:MMLU 跑分翻倍

alejandroll10 · x · 2026-08-17

社区发布了基于 Qwen3.8-2.4T-A95B 的蒸馏模型,规模为 9B/4B/2B。通过全参数 SFT 和精心筛选的教师 CoT 数据,小模型能力显著提升:9B 模型 MMLU 从 54.6 升至 75.1,4B 从 35.4 升至 55.3,2B 从 28.3 升至 54.8。目前权重和 GGUF 格式已发布。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →