NVIDIA 发布 LoGRA:强化学习训练显存最高省 45.7%
mark_k · x · 2026-10-08
NVIDIA 新研究提出 LoGRA,通过把学习信号压缩成紧凑的「梯度草图」(gradient sketches)并控制每次更新的幅度以保持训练稳定,将强化学习训练的平均 GPU 显存占用降低最多 45.7%,同时在测试的推理任务上保持性能不降。模型仍通过权重更新学习,只是 GPU 上需驻留的信息大幅减少。
实测中,他们在单节点 8×H100 上对 27B 模型训练超过 1100 步;同样硬件上标准 Adam 优化器配置直接 OOM。作者点评:让更多训练塞进现有硬件意味着更多实验空间,这类效率改进值得关注。
所属事件:NVIDIA 推出 LoGRA,强化学习训练显存最高省 45.7%(2 条相关)→
「Infra」频道最新
- Surface AI 硬件周五开售:RTX Spark 版起售 2599 美元,Dev Box 5999 美元 — ryanshrout · 2026-10-08
- XPU Grasshopper 芯片宣称由 AI 协同设计,13 周性能提升 816 倍 — ycombinator · 2026-10-08
- 机密估算显示 NSA 每年花费数十亿美元测试前沿 AI 模型 — coherence · 2026-10-08
- 为省一微分钱,超大规模云厂商在可插拔光模块上有多拼 — jwt0625 · 2026-10-08
- 128GB Mac 跑 341GB DeepSeek:砍代码库让 agent 提速 2 倍 — Chida82 · 2026-10-08
- Windows 现场 demo:编码任务被自动路由到本地模型,llama.cpp 已接入 Windows ML — ryanshrout · 2026-10-08