英伟达GB300系统推理能效达Hopper十倍
nvidia · x · 2026-07-15
英伟达(NVIDIA)官方发文强调,从基准测试到实际生产部署,GB300 NVL72 系统能够提供业界领先的每瓦性能,旨在最大化收益并实现最低的 token 成本。
官方在回复中透露了具体对比数据:在运行 Kimi K2.6 模型时,GB300 NVL72 系统的每瓦性能最高可达上一代 Hopper 架构的 10 倍。
所属事件:英伟达GB300推理能效达Hopper十倍(2 条相关)→
「Infra」频道最新
- Engram 随机读取不适合 SSD,CPU 内存低延迟共享或成正解 — bookwormengr · 2026-09-11
- 劝退帖:推理工程是真金白银的硬活,八成尝鲜者已悄然放弃 — abhijithneil · 2026-09-11
- Hugging Face《Ultra Scale Playbook》:GPU 集群训练 LLM 的免费技术书 — mdancho84 · 2026-09-11
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- 推理服务关键指标盘点:流式速度 TPOT 与可用性如何影响体验 — abhijithneil · 2026-09-11
- PlanetScale 推出分片 Postgres,768 台服务器组成 1PB 单库 — dhruv2038 · 2026-09-11