GLM-5.3-Flash 登顶基准,推理速度达 294 tok/s
Arindam_1729 · x · 2026-09-01
Zai 旗下的开源模型 GLM-5.3-Flash(又名 Ox Alpha)在 Artificial Analysis 基准测试中夺得第一名。该模型在 Nebius 平台上运行,实现了惊人的 294 tokens/s 推理速度,创下了该基准的历史纪录。
模型关键特性:
- 极速推理:294 输出 tokens/秒,适合对延迟敏感的应用。
- 超大上下文:支持 100 万 token 上下文窗口。
- 隐私安全:零数据保留(Zero data retention)。
- 多模态能力:具备多模态处理能力。
所属事件:GLM-5.3-Flash 借 Nebius 平台登顶推理速度榜(2 条相关)→
「Infra」频道最新
- Omarchy 首次在 Linux 破解 T1 芯片 TouchID — DanWahlin · 2026-09-01
- 数据商是否开始训练自己的模型? — xeophon · 2026-09-01
- 别让编程 Agent 24小时空跑:省电与硬件维护指南 — Rhishi99 · 2026-09-01
- Token 算力资源价差巨大,自部署 GLM 与 DeepSeek 低至 2 折 — lipeng0820 · 2026-09-01
- Whale 5 月论文首次提出多平面网络架构,影响 AI 训练与芯片设计 — bookwormengr · 2026-09-01
- 猫咪趴在两台 DGX Spark 上阻碍散热 — jonstephens85 · 2026-09-01