JoyNexus:面向服务的多租户VLA模型后训练
摘要
JoyNexus提出了一种用于多租户VLA模型后训练的统一服务,将训练、推理和环境服务解耦,采用共享基础模型和租户专属插槽,通过分组批处理和调度提高效率。
查看缓存全文
缓存时间: 2026/07/21 06:35
论文页面 - JoyNexus:面向服务的多租户VLA模型后训练
来源:https://huggingface.co/papers/2607.16074 作者:
,
,
,
,
,
,
,
,
,
,
,
,
,
,
,
,
,
,
,
摘要
由于模拟器、机器人本体和任务目标的多样性,视觉-语言-动作(VLA)模型的后训练至关重要。现有的计算服务,无论是直接提供加速器租赁还是批处理工作负载提交,通常都会为单个租户分配一组独占的GPU和CPU资源。虽然这种模式最大化了客户端的灵活性,但给用户带来了基础设施适配的负担,而且固定的按卡计费模式使得短时间或突发性工作负载对租户而言成本高昂,对服务提供商而言效率低下。为了应对这些挑战,我们提出了JoyNexus,一个面向多租户VLA监督微调、强化学习和评估的统一服务。JoyNexus将训练模型服务、推理模型服务和环境服务解耦,每个服务通过API访问,并由驻留的共享基础模型及租户专属插槽提供支持。租户可以直接调用高级语义API进行训练、推出和评估,也可以使用低级API及其分配到的端点组合自定义算法。多个租户同时提交工作负载;他们的动作模块、优化器、推出记录和策略版本保持隔离,服务由全局训练队列和推理队列调度。为了进一步提升多租户训练效率,JoyNexus引入了针对共享兼容模型前缀的异构VLA数据模式的组批处理,使得分组样本能够在单个共享骨干网络前向传递中处理。最后,我们通过工作负载模拟和在真实具身场景中的组批处理管线来评估JoyNexus。结果表明,与隔离的单租户执行相比,JoyNexus通过在共享资源上进行跨租户调度,减少了总GPU时间并提高了服务利用率。
查看arXiv页面 (https://arxiv.org/abs/2607.16074)查看PDF (https://arxiv.org/pdf/2607.16074)添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2607.16074)
在你的agent中获取本文:
hf papers read 2607.16074
没有最新CLI?curl -LsSf https://hf.co/cli/install.sh | bash
引用该论文的模型 0
没有模型链接到此论文
在模型README.md中引用arxiv.org/abs/2607.16074即可从本页链接。
引用该论文的数据集 0
没有数据集链接到此论文
在数据集README.md中引用arxiv.org/abs/2607.16074即可从本页链接。
引用该论文的空间 0
没有空间链接到此论文
在空间README.md中引用arxiv.org/abs/2607.16074即可从本页链接。
收藏该论文的合集 1
相似文章
D-VLA: 面向视觉-语言-动作模型的高并发分布式异步强化学习框架
D-VLA 提出了一种高并发分布式异步强化学习框架,用于视觉-语言-动作模型,采用平面解耦和泳道管线提升大规模具身智能训练中的吞吐量和效率。
从基础到应用:在实践中改进VLA模型
本文介绍了LingBot-VLA 2.0,它通过改进跨任务和具身形态的泛化能力、将动作空间扩展至全身自由度,并引入预测动力学建模以提升时间推理能力,从而增强了用于机器人技术的VLA基础模型。
DynaTrain: 面向弹性大语言模型训练的快速在线并行度切换
DynaTrain 是一个分布式训练系统,能够在大语言模型上实现亚秒级在线并行度重配置,通过虚拟参数空间抽象,使转换速度比现有方法快多达三个数量级。
AutoTrainess:自主教语言模型改进语言模型
AutoTrainess 提出了一种语言模型智能体框架,通过将人工工作流外部化为明确的接口(包括规划、数据准备、训练、评估和日志记录)来自动化后训练过程,在 PostTrainBench 上相较于仅 CLI 的基线实现了显著提升。
@_avichawla: https://x.com/_avichawla/status/2077653695123378321
本文认为,vLLM及类似的服务框架由于设计限制,在单个GPU上运行多个小型AI模型时效率低下。它介绍了SIE开源推理引擎,作为同时服务多个模型以降低成本的一种解决方案。