中港团队开源 Libra,智能体训练吞吐提升 3 倍
jiqizhixin · x · 2026-08-21
香港中文大学团队发布 Libra,旨在解决智能体 RL 后训练中的资源争抢问题。
- 痛点:长轨迹、重度工具调用的任务霸占 GPU,导致训练与部署资源冲突。
- 方案:
- 全局规划器:通过弹性混合池动态在推理(rollout)和训练之间切换 GPU。
- 因果调度器:基于实际工具返回信号(而非脆弱的长度预测)路由请求,应对不可预测负载。
- 效果:在 48 张 A800 GPU 上测试,吞吐量提升 3.0 倍,奖励收敛速度比基线快 2.5 倍。
「Infra」频道最新
- Unsloth V3 版 Qwen 模型在双 AMD 卡上崩溃 — Equivalent-Ear-8016 · 2026-08-21
- 开源 x402-cleanweb-agent:网页转 Markdown 省 80% Token — EstablishmentTough18 · 2026-08-21
- 预训练还有巨大优化空间,算力是唯一瓶颈 — zeeshanp_ · 2026-08-21
- 算力账本:宣称日处理 100T token 需要约 58 万张 GPU? — teortaxesTex · 2026-08-21
- 摩尔定律失效在即,非硅计算与新型架构将迎资本热潮 — MikePFrank · 2026-08-21
- 「不懂为什么要建数据中心,写快点内核不就行了」 — basedjensen · 2026-08-21