GLM-5.2在4×DGX Spark上的4-bit实测
anvarazizov · reddit · 2026-07-09
开发者将 GLM-5.2 (753B MoE) 量化至 Int4-Int8Mix,在 4× DGX Spark 上以 100K 上下文运行 Terminal-Bench 2.1 测试。结果显示其得分达到 70.8%,达到了官方全精度模型(81.0%)约 87% 的水平。文章详细分享了量化部署过程中的技术栈配置与遇到的工程挑战。
「Infra」频道最新
- 推理服务关键指标盘点:流式速度 TPOT 与可用性如何影响体验 — abhijithneil · 2026-09-11
- PlanetScale 推出分片 Postgres,768 台服务器组成 1PB 单库 — dhruv2038 · 2026-09-11
- 7900 XTX 24GB 能否跑 Qwen,Reddit 征集 ROCm 实测数据 — thenomadexplorerlife · 2026-09-11
- 实测戳破 RTK 省钱神话:token 省了,账单分文未降 — Bartaseth · 2026-09-11
- SF Compute 创始人:现在买算力是「绝对糟糕的体验」 — IgorCarron · 2026-09-11
- 开源 SmolVM:2026 年 Agent 不止用浏览器,而是拥有整台电脑 — aniketmaurya · 2026-09-11