GLM-5.3-Flash 量化至 4-bit 仍保留 93% 准确率

amaarora · x · 2026-08-28

GLM-5.3-Flash (ox-alpha) 模型可量化至 4-bit 并保留 93% 的准确率。实测显示,该 4-bit 模型表现接近本地版 Claude 4.7 Opus。模型可在 256GB Mac 或两张 DGX Spark 上完美运行,5-bit 量化可能也可行。UnslothAI 团队还提供了 3-bit 版本(需 128GB RAM)的 GGUF 格式运行指南。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →