GLM 5.2 FP8 量化跑 Terminal-Bench 2.1

Daemonix00 · reddit · 2026-07-06

有开发者实测 GLM 5.2 在 FP8 权重加 FP8 KV 量化下运行 Terminal-Bench 2.1,得 79.8%(89 题通过 71,失败 17,超时 1),并借此对比官方成绩。部署环境为 H200 上的基础 sglang,缓存命中率达 98.8%;其中一个超时任务未重跑,成绩可能还有提升空间。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →