Nvidia Vera Rubin 真能加速 LLM 预训练吗?10T 参数模型是否将至
Witty_County5128 · reddit · 2026-09-29
一位用户提问:Nvidia Vera Rubin 公布的数字看起来很夸张,但大部分头条增益似乎与低精度格式和推理相关,这些有多少能真正迁移到预训练?
他还好奇是否会出现 10T+ 参数模型,还是说数据、电力与成本才是真正的瓶颈,行业会继续聚焦 MoE 和更好的数据而非单纯做大。他向有硬件或训练经验的人征求意见。
「Infra」频道最新
- YC 系 InstaCloud 上线:一条命令让 Claude Code 等 Agent 自管云基础设施 — testingcatalog · 2026-09-29
- 浓缩是核电瓶颈,核电是电力瓶颈,电力是 AI 瓶颈 — le_james94 · 2026-09-29
- Turso 0.8.0 发布:并发写入下比 SQLite 快 7 倍、尾延迟低 500 倍 — glcst · 2026-09-29
- AMD AI Max+ Pro 上市:192GB 统一内存抢先 NVIDIA Spark 50% — ryanshrout · 2026-09-29
- 创始人聚会都在聊去哪买算力:Instinct 需求每周翻倍 — ai · 2026-09-29
- NVIDIA 牵头成立 Open Secure AI Alliance,主打开源 AI 安全 — perplexity_ai · 2026-09-29