NVIDIA 提出 Draft Co-Training,加速大规模长上下文 RL 后训练推理

nvidia · hf · 2026-09-09

NVIDIA 发布论文 Online Draft Co-Training for Speculative Decoding,针对大规模长上下文 RL 后训练的推理加速。

技术要点:

解决了 RL 后训练中生成吞吐瓶颈,在长上下文场景下尤为重要。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →