谷歌 Hot Chips 发布第八代 TPU:一年两款芯片,推理训练分开设计
firstadopter · x · 2026-09-03
- Google 在 Hot Chips 2026 会议上由 TPU 技术负责人 Norman Jouppi 与芯片架构高级总监 Sridhar Lakshmanamurthy 介绍第八代 TPU。
- 历代 TPU 累计已实现约百万倍性能提升;从第一代 PCIe 推理卡演进至今。
- 关键变化:从一年一款改为一年两款芯片,推理优化与训练优化设计分化,以覆盖从 10 万+ 芯片的超大规模预训练到几颗芯片的小模型推理、蒸馏、MoE 与 agent 模型。
- MoE 与 agent 模型带来远超以往的通信需求——FLOPs 容易扩展、互联难扩展,本代在互联扩展上投入大量工作。
「Infra」频道最新
- 实地探访里士满 240MW AI 数据中心:噪音意外安静 — AndyMasley · 2026-09-03
- Carmack 重提 Rotovator:动量交换缆绳或成太空数据中心低成本入轨方案 — ID_AA_Carmack · 2026-09-03
- 双 DGX Spark 实测:GLM-5.3-Flash 写作与视觉胜过 DeepSeek-V4-Flash — kuhunaxeyive · 2026-09-03
- Jeff Dean 2007 年幻灯片流出:数据中心硬件故障实录 — SumitGup · 2026-09-03
- 数据中心耗水是迷思?现代机房多用闭路冷却,用水仅如写字楼 — GlenBradley · 2026-09-03
- 推理工程吃香:vLLM/SGLang 搭副本加缓存路由核心配方 — GabGarrett · 2026-09-03