GLM-5.3-Flash 火爆流量全靠国产芯片承载,且非最先进制程
teortaxesTex · x · 2026-08-27
智谱本周揭晓的 GLM-5.3-Flash(即匿名测试的 "Ox Alpha",320B-A18B)在 OpenRouter 和 OpenCode 上创下使用纪录,而公司表示这些流量全部由国产芯片集群承载推理。
博主 teortaxesTex 指出,更有意思的是这些甚至不是中国当前量产代次里最好的芯片,到年底情况还会进一步改善。另据提及,华为 950s 原定 8 月开始大规模销售。知乎作者刘延还原了智谱如何搭建这套基础设施,并从官方工程细节推断实际在用的芯片。核心判断是:更大的故事不是模型本身,而是一个前沿级模型在全球规模的现实推理负载上跑在了国产硅片上。
所属事件:Ox Alpha 身份揭晓:智谱 GLM-5.3-Flash 跑在国产芯片(9 条相关)→
「Infra」频道最新
- Core Lightning 遭 AI 生成大量虚假 CVE 报告 — RSync25 · 2026-08-27
- 实测:OX Alpha WebGPU 运行成本仅 0.016 美元 — yuwen_lu_ · 2026-08-27
- PyTorch 生态新增 Perforated 等 10 个项目 — zhyncs42 · 2026-08-27
- Jalapeño 芯片能效超竞品 1.9 倍,吐槽文档晦涩 — Artistic_Phone9367 · 2026-08-27
- 8 张 3090 跑 SlimServe:262k 上下文每秒 661 token — QuixiAI · 2026-08-27
- OpenAI 内部妥协风险或被低估,基础设施是关键 — sjgadler · 2026-08-27