Fireworks 发布 ARCv3:RL 权重更新体积减半,跨区域训练更可行
sophiamyang · x · 2026-09-24
Fireworks 推出新版 RL 压缩器 ARCv3,用于压缩从训练器发送到 RL rollout 机器的 BF16 权重更新。要点:- 在 1000 个生产环境 RL 权重更新 delta 上实测,ARCv3 载荷比 ARCv2 小近 50%,且能无损重建训练器的精确 BF16 权重;- 更小的传输量让 rollout 集群更贴近当前策略,使跨区域使用算力(而不必建一个巨型同地集群)变得更实际;- 已通过 fireworks-delta-compression 在 Fireworks Training API 上线,支持自带 trainer 的团队搭配 Fireworks rollout 使用。
「Infra」频道最新
- AI 医疗推高 GPU 需求,Neocloud 转向按需现货定价 — Arindam_1729 · 2026-09-24
- 开源 DeskPilot:纯 Python 本地 LLM 桌面 Agent 客户端,内置 MCP 与安全沙箱 — poofph · 2026-09-24
- 论文跑分忽略 gVisor,网友实测内存超卖与调度收益 — sloppenheimer · 2026-09-24
- vLLM 实测 TPUv7 达 700 tok/s,比英伟达 GB200 NVL72 快 56% — woosuk_k · 2026-09-24
- 爆论:模型「变笨」或因异构 GPU/TPU 混用推理,质量不一 — michellechen · 2026-09-24
- GKE 1.37 推出原生缩容到零,挑战 KEDA 方案 — rseroter · 2026-09-24