智谱自建推理基础设施,公开 GLM 服务背后的工程细节
whiteros_e · hn · 2026-09-17
智谱(z.ai)发布博客,介绍其为 GLM 系列模型自建的推理基础设施。文章披露了从算力调度到推理服务栈的自研思路,说明其为何选择自建而非完全依赖第三方云,以优化吞吐、延迟与成本。对关注国产大模型推理侧工程实践与算力经济的人来说是一份少见的厂商一手材料。
「Infra」频道最新
- 团队 Key 各自为政,Reddit 求企业 LLM 网关选型经验 — almost1it · 2026-09-18
- 双 7900 XTX 消费机跑出 82 tok/s:RDNA3 优化版 llama.cpp 分支 — deathcom65 · 2026-09-18
- NVIDIA DGX Station GB300 现场演示:本地跑出每秒数千 token — TheZachMueller · 2026-09-18
- OpenAI 高管:GPU 每瓦 7-40 IQ 点,已超人类的 5 — GregCook2011 · 2026-09-18
- 烧结稀土磁体:中国精炼 91%、制造 94%,AI 硬件供应链真正的卡点 — demian_ai · 2026-09-18
- 神秘买家豪掷 1 亿美元权利金,狂买 10 月 2 日到期 AI 股看涨期权 — toptickcrypto · 2026-09-18