Qwen27B手机端压缩再强调

xiaohu · x · 2026-07-15

PrismML 继续强调其把 Qwen3.6-27B 压缩到手机可跑的结果:约 54GB 的模型被压到 3.9–5.9GB,并称在测试中能保留原版大部分能力。

文中再次给出性能数据:Ternary 版约保留 95% 战斗力,1-bit 手机版约保留 90%,并提到在 RTX 5090 和 Apple M5 Max 上的推理速度表现。

所属事件:Bonsai 27B 发布:首个可在手机运行的 27B 模型(15 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →