GLM 5.2 Flash 登陆 Mac,M5 Max 可跑 Q2 量化版
antirez · x · 2026-08-28
antirez 发布了 GLM 5.2 Flash Q2 版本,采用与 DwarfStar GGUF 类似的方案,可在配备 128GB 内存的 M5 Max 上运行。此外,Q4 权重支持在两台 M5 Max 上进行张量并行推理。该项目目前正在测试中,即将发布到 GitHub。
所属事件:antirez 移植 GLM 5.2 Flash,M5 Max 可本地运行(2 条相关)→
「Infra」频道最新
- Azure 教程:让 CI/CD 流水线无密钥访问 Cosmos DB — adnan_hashmi · 2026-08-28
- Inference Perf:Kubernetes 社区标准化推理性能评测 — TerryTangYuan · 2026-08-28
- ThursdAI 聊数据中心反弹:有人真算了水和能源账 — altryne · 2026-08-28
- AISI 开源 optstop 工具,降低大模型评测 Token 消耗 — HZoete · 2026-08-28
- 英伟达预测下一财年收入增长约 70%,AI 算力需求持续飙升 — Polymarket · 2026-08-28
- GPU 繁荣下的隐忧:科技公司的循环需求催生泡沫? — DavidLinthicum · 2026-08-28