RL Rollouts 官方文档:热加载 checkpoint 的部署与配置细节
_ScottCondron · x · 2026-10-07
CoreWeave 发布的 RL Rollouts 官方文档(预览版),补充了此前公告的技术细节:该功能用于在 Dedicated Inference 部署中服务 RL rollout 并热加载更新后的 policy 权重。
关键点:
- 支持从 CoreWeave AI Object Storage 加载全量或增量 checkpoint,不重启推理进程、不重建副本。
- 热加载按组织粒度开启,且要求使用 dynamo-vllm 引擎(基于 NVIDIA Dynamo + vLLM)。
- API 版本为 v1alpha1,GA 前可能变更。
- 文档覆盖创建支持热加载的部署、生成 rollout、发布 checkpoint 及确认所有副本已服务新权重的完整流程。
所属事件:CoreWeave 推出 RL Rollouts,权重热加载比重新部署快约 15 倍(2 条相关)→
「Infra」频道最新
- PyTorch 用 Triton 替换 CUDA,推荐系统 kernel 前向提速 1.28 倍 — PyTorch · 2026-10-07
- B200 价格飙升,网友调侃英伟达该反思卖卡对象了 — matt_slotnick · 2026-10-07
- Google 与 MIT 发布 Coco:用智能体辅助 TPU 硬件-模型协同设计 — dair_ai · 2026-10-07
- 单 GPU 开发者自建桌面 API 网关:统一 OpenAI/Anthropic 兼容接口 — rootshelldev · 2026-10-07
- PyTorch 大会将讲 DeepSpeed 张量/序列/专家并行新用法 — PyTorch · 2026-10-07
- 曝 SpaceX 拟融资 400 亿美元购置英伟达 AI 芯片,Apollo 牵头 — Polymarket · 2026-10-07