NVIDIA 开源 9.2K 行 Molt:面向智能体强化学习
burny_tech · x · 2026-07-28
NVIDIA 推出面向 agentic RL 的 Molt
NVIDIA 发布了 Molt,一个 PyTorch 原生的 agentic reinforcement learning 框架,目标是把研究代码做得足够小、足够清晰,便于研究者从头追踪整个训练流。
- 代码规模约 9.2K 行,可扩展到 1T 级 MoE 模型。
- 框架采用 全异步 rollout 设计,并与 vLLM 集成。
- 论文指出,agentic RL 往往会在估计器、rollout、训练后端和胶水代码上不断膨胀;Molt 想把这些复杂度压下去。
- NVIDIA 表示,在匹配的异步协议下,Molt 的表现与基于 Megatron 的最先进栈统计上可比。
- 项目是 开源 的,并提供了 GitHub 上的 recipes 和容器。
所属事件:英伟达开源 Molt 框架,发力智能体强化学习(3 条相关)→
「Infra」频道最新
- Cerebras 放话:多代晶圆级路线图保住最快推理王座 — Sethwinterroth · 2026-08-26
- NVIDIA 推出 Groq 3 LPX 加速 AI Agent — badumtsssst · 2026-08-26
- 数据中心耗水量少于降雨量?专家质疑干旱地区适用性 — tdietterich · 2026-08-26
- 博主批评苹果软件栈落后,称 M7 难跑下一代 Agent — teortaxesTex · 2026-08-26
- DFlash2 推理加速实测:4080 16GB 跑 Qwen3.8-27B 速至 86.7 tok/s — Apprehensive_Bar6609 · 2026-08-26
- Toloka Train 推出微调与压缩工具,降本达 37 倍 — MParakhin · 2026-08-26