Rubin 推理成本降 10 倍,2028 年 Kyber 单域将互联 1152 块 GPU
imadade · reddit · 2026-09-10
一位 Reddit 用户梳理了 NVIDIA 未来几年的算力路线图,认为算力跃升正在打开新的 scaling 轴:
- 2025 Blackwell:当前前沿模型的主力训练芯片,最新内部模型已混用 Blackwell + Rubin。
- 2026 Rubin:8 月刚进入量产爬坡。NVIDIA 称训练部分 MoE 模型可比 Blackwell 少用 4 倍 GPU,推理 token 成本最高降 10 倍,HBM 带宽/容量与互联带宽大增,利好大规模 agent 集群和长推理链。作者认为 OpenAI 求解 Navier-Stokes 已是早期信号。
- 2027 下半年 Rubin Ultra:NVL576 拓扑把 8 机柜 576 块 GPU 连成一个全互联 NVLink 域,数百块 GPU 表现如一台巨型加速器;已用 Blackwell 硬件做出功能原型。将大幅提升推理预算、agent 数量、搜索与合成数据生成规模。
- 2028 Feynman:GTC 2026 确认,采用 die-stacked GPU、新一代定制 HBM、Rosa CPU、LP40 推理硬件、BlueField-5 等;核心是 NVLink 8 + Kyber,即 NVL1152——8 机柜 1152 块 GPU 同处一个 scale-up 域,解决共享内存、GPU 间通信与推理吞吐瓶颈。
「漫话AGI」频道最新
- 评论者:AI实验室喊减速实为算力缺钱,别拿「太聪明」当借口 — CtrlAltDwayne · 2026-09-10
- Jen Zhu Scott 质疑「AI 灭绝人类」叙事缺具体论证 — kevinnbass · 2026-09-10
- AI 让小团队表面像大公司:公司很小,覆盖面巨大 — alexmacgregor__ · 2026-09-10
- 「模型也资历过剩」:用前沿大模型做简单任务是持续烧钱 — rachel_l_woods · 2026-09-10
- 美国大型算力公司联合创始人公开支持AI监管 — MxMnr · 2026-09-10
- 纽约四日访谈:普通人普遍讨厌 AI,作者用东西方身份观解读差异 — Linahuaa · 2026-09-10