PrismML 三值压缩 Qwen3.8 27B 至 5.9GB,能力保留 98.2%

dl_weekly · x · 2026-09-28

PrismML 发布 Bonsai 2 27B:用三值(ternary,+1/0/-1)权重量化把 Qwen3.8 27B 从约 56GB(16-bit)压到 5.9GB,保留约 98.2% 能力,Apache-2.0 开源,可在消费级 GeForce 5090 上以约 143 tokens/秒运行。

评测对比原模型:

相比常规量化,ternary 在大幅缩小体积的同时保持了接近原始智能水平,使大模型能跑进 PC 甚至部分高端移动设备。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →