Z.ai 全用国产芯片跑通 GLM-5.3,算力成本降超 40%
yogthos · reddit · 2026-08-28
Z.ai 宣布其 GLM-5.3-Flash 模型推理已完全迁移至中国国产 AI 芯片运行,不再依赖 NVIDIA 硬件。实测数据显示,相比使用 NVIDIA GPU,采用国产芯片方案将算力成本降低了 40% 以上。文章指出,这一成果验证了中国国产算力基础设施在大规模 LLM 推理中的可行性与经济性,对降低 AI 运营成本具有示范意义。
「Infra」频道最新
- 探讨光网络 LPO/NPO/CPO 技术路径 — BenBajarin · 2026-08-28
- RTX 3090 部署 Qwen3.8-27B:vLLM 胜出 — Lower-Ad6101 · 2026-08-28
- ASML 镜头产能成 AI 晶圆厂新瓶颈 — TheZvi · 2026-08-28
- 英伟达详解 QAD 优化模型性能流程 — PyTorch · 2026-08-28
- 开发者用四台 Mac Studio 跑 291B 模型 — eptwts · 2026-08-28
- Harness 推出 AI 代码仓库,专为应对高频 Agent 提交设计 — rseroter · 2026-08-28