FP8 统一用于训练与推理解码,RL 端到端提速 16%

joecole · x · 2026-07-30

NVIDIA、MIT 等机构联合发布的新论文 Jet-RL 深入研究了在大语言模型(LLM)的强化学习(RL)训练中使用 FP8 量化的稳定性问题。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →