Marin 535B 模型启动训练,全程透明开源
ysu_nlp · x · 2026-08-22
Marin 535B-A23B 模型本周开始训练,整个训练过程完全公开。该模型将在 11 个 GB200 NVL72 集群上训练约 3 个月,涉及 18.75T tokens 和 2.7e24 FLOPs。正式运行前,团队通过 1.6B 到 27.7B 参数的阶梯式模型进行调试和预测。
所属事件:斯坦福 Marin 开源 23T token 数据并启动 535B 透明训练(6 条相关)→
「Infra」频道最新
- Meta 年投数亿美元买 Azure 算力,周耗数万亿 Token — Beth_Kindig · 2026-08-23
- 超 50% GitHub 容量问题源于低效 CI 任务 — cramforce · 2026-08-23
- 47 美元运行 DeepSeek-V3:剪枝加量化实现 47 tok/s — StefanoGogioso · 2026-08-23
- 呼吁让顶尖建筑师设计数据中心外观 — EddyVGG · 2026-08-23
- 预测市场:明年底前发射太空数据中心概率 25% — Polymarket · 2026-08-23
- 风投提议在美墨边境建巨型数据中心网络 — Polymarket · 2026-08-23