谷歌据报研发 Frozenv2,专为 Gemini 定制的芯片效率或高 10 倍
新智元 · wechat · 2026-07-21
这篇报道说,谷歌正在研发代号 Frozenv2 的服务器芯片,思路是把 Gemini 的部分架构直接刻进硅片里。
- 不是把模型“跑在芯片上”,而是把关键决策路径直接内建到芯片电路里。
- 报道称,它的单位功耗 Token 处理效率可能比谷歌最新一代 TPU 高 6 到 10 倍。
- 最快部署时间据称是 2028 年。
- 文章把这视为谷歌在算力吃紧背景下,向更专用推理芯片继续加码的动作。
所属事件:谷歌被曝研发Gemini专用芯片Frozen v2(10 条相关)→
「Infra」频道最新
- Engram 随机读取不适合 SSD,CPU 内存低延迟共享或成正解 — bookwormengr · 2026-09-11
- 劝退帖:推理工程是真金白银的硬活,八成尝鲜者已悄然放弃 — abhijithneil · 2026-09-11
- Hugging Face《Ultra Scale Playbook》:GPU 集群训练 LLM 的免费技术书 — mdancho84 · 2026-09-11
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- 推理服务关键指标盘点:流式速度 TPOT 与可用性如何影响体验 — abhijithneil · 2026-09-11
- PlanetScale 推出分片 Postgres,768 台服务器组成 1PB 单库 — dhruv2038 · 2026-09-11