Qwen3.8-27B 深度剪枝版发布:参数减至 22.7B
peplo1214 · reddit · 2026-08-20
作者通过深度剪枝策略将 Qwen3.8-27B 模型参数减少至约 22.7B,未进行微调。该模型在编码、Agent 和多轮对话场景下表现良好,体积更小且推理更快。目前提供 bf16、q8 和 q4 版本,适合对资源有要求的项目使用。
「模型」频道最新
- 模型已能在 1 小时内写出复杂软件 — BLUECOW009 · 2026-08-20
- Qwen3.8 与 Gemma4 等多模型本地部署量化横评预告 — karminski3 · 2026-08-20
- Claude Code 遭遇水逆,替代品评测出炉 — Hesamation · 2026-08-20
- 实战:用 Ling 3.0 Tiny 做 Qwen Agent 的加速辅助 — My_Unbiased_Opinion · 2026-08-20
- Luna 仍最划算,Qwen 3.8 27B 性价比排第四 — MikePFrank · 2026-08-20
- GLM-5.3上线进全球前沿区间,Cerebras称推理快GPU三十倍 — 创业邦 · 2026-08-20