OpenAI 曝训练吞吐提升 4.1 倍、集群利用率超 95%
LiamFedus · x · 2026-09-16
OpenAI 研究者 Liam Fedus 分享了其基础设施目标「每 GPU 小时的科学产出」。在实际工作负载上,他们相对自家 Megatron 基线取得 4.1× 训练吞吐、2.5× 更快解码、95%+ 集群利用率,并将改进回馈到 Megatron-LM、SGLang 和 Miles 等开源社区。
另一条相关回复展示了实际科研收益:在 X 射线衍射分析任务上,实验室数据 + midtraining + RL 把 134 个困难样本上的成功率从 2.7% 提升到 55.3%(约 20×),由与人类专家校准过的模型评委打分,且随 RL 增加呈良好 scaling 特性。
「Infra」频道最新
- MLPerf Inference v6.1 即将揭晓:30 家提交者与新加速器同台竞技 — TheKanter · 2026-09-16
- Lambda 用 NVIDIA DSX MaxLPS:同功率预算多跑 3 节点,吞吐增 24% — TheZachMueller · 2026-09-16
- NVIDIA 演示 AI 工厂电网调峰:200 次需求信号全部响应成功 — nordicinst · 2026-09-16
- AI Infra Summit:NVIDIA Vera Rubin 与 DSX 主打每瓦 token 效率 — nordicinst · 2026-09-16
- 英伟达发布 DSX AI 工厂平台:榨干每兆瓦算力产出 — nvidia · 2026-09-16
- 320 美元 GPU 跑 125B MoE?网友晒 22 tok/s 本地方案 — cephaloform · 2026-09-16