@sgl_project:SGLang很荣幸能成为Miles的原生rollout引擎。我们致力于让token持续流转,让GPU保持忙碌状态...
摘要
SGLang正式宣布成为Miles v0.1的原生rollout引擎。Miles是一个针对大语言模型与多模态模型的开源强化学习框架,旨在提升大规模强化学习训练中的吞吐量、缓存效率与稳定性。
查看缓存全文
缓存时间: 2026/08/18 18:32
SGLang 荣幸成为 Miles 的原生推演引擎。我们将致力于确保令牌流动顺畅、GPU资源充分利用
很高兴看到越来越多的团队在采用 SGLang 进行训练后推演。我们将持续优化吞吐量、缓存效率和开箱即用的模型覆盖,确保强化学习任务在任何规模下都能保持高效稳定运行
RadixArk (@radixark): 今日我们正式推出 Miles v0.1——面向大语言模型与多模态模型的开源强化学习框架。
强化学习训练易上手却难调试。Miles 可帮助您验证运行逻辑、提升硬件利用率,并实现大规模强化学习任务的稳定运行。
在过去9个月里,已有72
相似文章
@MiniMax_AI:祝贺我们的长期合作伙伴SGLang/RadixArk发布Miles v0.1!从M系列到H3和Music 3,我们一直……
RadixArk发布Miles v0.1,这是一个开源强化学习框架,专为大型语言模型和多模态模型设计,旨在简化和扩展强化学习训练。
Miles v0.1: 生产级后训练 (阅读约20分钟)
Miles v0.1 是一个生产就绪的系统,用于前沿后训练,通过SGLang优化完全异步的强化学习循环和智能体展开。
Miles:用于大规模LLM强化学习后训练的PyTorch原生栈(14分钟阅读)
Miles是RadixArk推出的一个开源的PyTorch原生框架,用于大规模LLM强化学习后训练,集成了SGLang、Megatron-LM和Ray,以实现高吞吐量的推演和分布式训练。
@PyTorch: 基于PyTorch、Ray、SGLang和NVIDIA Megatron-LM构建,Miles是RadixArk推出的一个用于大规模……的开源框架
Miles是RadixArk推出的一个开源框架,用于大规模LLM强化学习后训练,集成了PyTorch、Ray、SGLang和NVIDIA Megatron-LM,支持MoE、低精度和容错。
@modal: 我们与 @lmsysorg 和 http://z-lab.ai 合作,将 DFlash 规范集成到 @sgl_project,并通过重叠加速……
Modal 与 LMSys 和 Z Lab 合作,将 DFlash 推测解码集成到 SGLang,在大型语言模型上实现了相比基准最高 4.3 倍的吞吐量提升,比原生多 token 预测提升 1.5 倍。