JoyNexus 把 VLA 后训练做成多租户共享服务

Haoran Sun · hf · 2026-07-21

# JoyNexus:面向 VLA 模型后训练的多租户服务 这篇工作提出一个统一服务,用来支持 Vision-Language-Action(VLA)模型的 **监督微调、强化学习和评估**。 它的重点不是单一算法,而是训练服务架构: - 将系统拆成 **Training Model Service / Inference Model Service / Environment Service**,分别通过 API 提供能力。 - 既支持高层语义接口,也允许用户用低层 API 组合自定义算法。 - 多租户并发提交任务时,各自的 action module、优化器、rollout 记录和 policy 版本彼此隔离。 - 通过全局训练队列和推理队列统一调度共享资源。 - 进一步提出 **group batching**,把前缀兼容的异构 VLA 数据批在一起,复用同一次 backbone 前向。 作者在工作负载模拟和一个真实具身场景中评估后发现,这套方案能减少总 GPU 时间,并提升共享资源利用率。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →