智谱 GLM-5.3 全程国产芯片运行,处理 62 万亿 token
pstAsiatech · x · 2026-08-27
智谱 AI 发布其最新开源权重模型 GLM-5.3-Flash(代号 Ox Alpha)。该模型在正式发布前的隐秘测试中,全程运行于 10 万块国产芯片集群上,累计处理了 62 万亿 token。在 OpenRouter 平台上线三天内处理量超 11 万亿 token,成为该平台史上最大发布,并在编码类模型使用量中排名第一。此举展示了中国在全自主硬件上处理大规模全球推理工作的能力。
所属事件:Ox Alpha 身份揭晓为智谱 GLM-5.3-Flash,国产芯片承载海量推理(18 条相关)→
「Infra」频道最新
- 卫报视频:人人讨厌的数据中心,AI 到底需不需要它们 — nordicinst · 2026-08-27
- AI 耗水问题究竟有多严重?引发多地抗议 — Ars Technica AI · 2026-08-27
- 美郊区洒水器两天用水超数据中心全年 — neil_chilson · 2026-08-27
- 开源模型已足以上手,端侧部署仍是硬骨头 — dscape · 2026-08-27
- 中国模型迭代速度是美国两倍,8周推理成本降80% — bindureddy · 2026-08-27
- Llama.cpp 配 ROCm 在 780M 上狂崩,一个环境变量救回来 — MaximusSenior · 2026-08-27