Z.ai 曝光 Ox Alpha 架构与国产算力底座
rohanpaul_ai · x · 2026-08-27
Z.ai 透露 Ox Alpha 实为 GLM-5.3-Flash,其大规模隐身流量由中国国产加速器支撑,而非 NVIDIA 集群。该模型总参数 320B,但推理时仅激活 18B;相比 GLM-5.2,价格降至十分之一,层数减半,且在 DeepSWE 等 Benchmark 上有显著提升。架构上采用线性注意力等优化,大幅降低计算开销。
所属事件:神秘模型 Ox Alpha 揭盅:智谱 GLM-5.3-Flash 纯国产芯片跑通(17 条相关)→
「Infra」频道最新
- 英伟达业绩揭示AI推理算力并非瓶颈 — pstAsiatech · 2026-08-27
- Mac mini M6 跑本地 8B 模型,三周没再撞 ChatGPT 用量上限 — ugcfast · 2026-08-27
- Grokpute 上线:分布式 GPU 训练网络 — jw2yang4ai · 2026-08-27
- Weaviate 推出查询剖析功能,一个参数定位慢查询瓶颈 — victorialslocum · 2026-08-27
- AI沙箱存储架构:本地根文件+S3 — aniketmaurya · 2026-08-27
- Weaviate 推出 effort 参数,可调搜索精度与算力成本 — CShorten30 · 2026-08-27