Mistral Large 4 仅用 4000 块 GPU 训练,竞品 Astra 用了 10 万块
steipete · x · 2026-10-07
NVIDIA 官方披露,Mistral Large 4(现处公开预览)的训练动用了近 4000 块 NVIDIA Grace Blackwell Superchip,号称「欧洲造的前沿级算力」。
但对比数据更显悬殊:有推文指出,对照组的 Astra 模型训练用了 10 万块 GPU,与 Mistral 的 4000 块相差 25 倍。Mistral 以小算力训练大模型的性价比路线能否站住脚,即将接受检验。
所属事件:Mistral Large 4 仅用约 4000 块 Grace Blackwell 在欧洲完成训练(4 条相关)→
「Infra」频道最新
- 21M 小模型配 6.4B 查找表,追平 114M 稠密模型 — fechyyy · 2026-10-07
- Ollama 0.35 引入本地决策模型:简单分类别再用聊天模型 — Technovangelist · 2026-10-07
- CostGraph 宣布成为 InfraCost 替代品,可查 L40 到 A100 各类 GPU 价格 — saheedniyi_02 · 2026-10-07
- Oki Home 推出「记忆电脑」:本机跑 27B 模型,1799 美元起 — Scobleizer · 2026-10-07
- 6 秒转录 1 小时语音:Phonon-2 Core ML 版达 606 倍实时,内存砍至 1.1GB — julianweisser · 2026-10-07
- HN 热帖:AI 已能自行设计推理硬件,openTPU 项目开源 — fsbonetto · 2026-10-07