Google DeepMind发布《如何扩展你的模型》:TPU/GPU系统视角
mdancho84 · x · 2026-08-14
Matt Dancho 分享了 Google DeepMind 的《如何扩展你的模型》指南,该书从系统视角讲解 LLM 在 TPU 和 GPU 上的运行原理、并行化策略、成本估算等,适合希望深入理解模型扩展的开发者。
所属事件:Google免费发布GPU大师课与扩展模型指南(2 条相关)→
「Infra」频道最新
- AI数据中心初创Nscale Q2营收破1亿美元,拟9月赴美IPO — Beth_Kindig · 2026-08-14
- 英伟达显卡再涨价,单卡售价达1.5万美元 — yacineMTB · 2026-08-14
- llama.cpp新选项:工具命令可在rootless沙箱容器中运行 — DevelopmentBorn3978 · 2026-08-14
- 提问:微调超1T开源模型后,最简单的推理托管方式是什么? — maksym_andr · 2026-08-14
- CoreWeave亏损翻倍、烧钱加剧,但投资者看好千亿订单 — rohanpaul_ai · 2026-08-14
- 什么是 prefill-decode 分离?现代推理栈为何转向此架构? — scareme_please · 2026-08-14