Prism ML 把 Qwen 27B 从 60GB 压到 6GB,1.5-bit 量化后可跑树莓派

rohanpaul_ai · x · 2026-10-08

Emad Mostaque 在 Tom Bilyeu 播客中展示极端量化进展:Alibaba Qwen 27B 常规需要约 60GB 内存,Prism ML 团队用 1.5-bit(而非 16-bit)存储数值,将其压到 6GB,同时保留约 95% 的性能。

所属事件:1.5-bit 量化让 Qwen 27B 可跑树莓派(3 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →