GLM-5.3-Flash 实测 270 tok/s:质量比 5.2 高 10%,成本仅十分之一

Yuchenj_UW · x · 2026-08-28

作者(Databricks 推理团队成员)宣布 GLM-5.3-Flash 推理速度达 270 tok/s。在团队自己的 OfficeQA Pro v2 基准上,GLM-5.3-Flash 以约 1/10 的成本实现比 GLM-5.2 高 10% 的质量——快、便宜、质量好三者兼得。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →