1.5-bit 量化让 Qwen 27B 可跑树莓派

Prism ML 团队将阿里巴巴 Qwen 27B 模型的数值精度从 16 bit 压至 1.5 bit,内存需求从约 60GB 降至 6GB,同时保留约 95% 的性能,使得树莓派等设备也能运行。Emad Mostaque 在 Tom Bilyeu 播客中以此为例,称 AI 模型的效率「已接近人脑」,展示了极端量化的最新进展。

2026-10-08 ~ 2026-10-08 · 3 条相关

另有 1 条近重复转述:rohanpaul_ai