1.5-bit 量化把 Qwen 27B 压到 6GB,树莓派也能跑

rohanpaul_ai · x · 2026-10-08

Prism ML 团队将阿里巴巴 Qwen 27B 模型的数值精度压到 1.5 bit(原为 16 bit),显存需求从约 60GB 降到 6GB,同时保留约 95% 的性能。6GB 意味着模型可以在树莓派上运行——Emad Mostaque 借此宣称 AI 模型「已基本达到人脑的能效水平」,因为树莓派的功耗与人脑相当。完整讨论见 Tom Bilyeu 频道视频。

所属事件:1.5-bit 量化让 Qwen 27B 可跑树莓派(3 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →