@vllm_project: 感谢所有出席、发言并在整个 vLLM Conference 中坚持的人。会谈门口排起的长队说明了…
摘要
vLLM Conference 成功闭幕,社区参与度高,会议记录可在讨论串中获取。
查看缓存全文
缓存时间: 2026/09/22 05:44
感谢所有到场、发言并全程参与vLLM会议的朋友。会场门口排起长队,足见这个社区的热情与凝聚力。
感谢@inferact的承办!会议录像已发布在讨论串中。
Inferact (@inferact): @vllm_project会议在Ray Summit圆满落幕。关于推理引擎的演讲竟让会场门口排起长队——这完美诠释了社区伙伴们的支持力度。
感谢@anyscalecompute与我们联合主办,我们已开始期待下次再见。
相似文章
@llama_index: POV:这是在 @Ai4conferences 的最后一天,你的:彩色帽子和贴纸遍布会议厅,CEO,@…
LlamaIndex 分享了 Ai4 大会最后一天的亮点,包括 CEO Jerry Liu 的主题演讲,以及与 AI 领袖共进的高管晚宴。
深入vLLM:高吞吐量LLM推理系统剖析(2025)
深入探讨vLLM用于高吞吐量LLM推理的架构与组件,涵盖调度、分页注意力、连续批处理、高级特性、扩展、服务及基准测试。
@anyscalecompute: Ray Summit 2026,与 @vllm_project 共同呈现。感谢合作伙伴和赞助商支持在旧金山为期三天的活动(8月24日至…)
宣布 Ray Summit 2026,与 vLLM 联合呈现,将于8月24日至26日在旧金山举行。完整议程已上线,涵盖基础模型训练、多模态流水线和大规模强化学习等主题。
@vllm_project: vLLM v0.21.0 发布!367 次提交,来自 202 位贡献者(其中 49 位新贡献者)。亮点:KV 卸载 + HMA、带思考预算的推测解码(适用于推理模型)……
vLLM v0.21.0 已发布,新增 KV 卸载 + HMA、面向推理模型的带思考预算的推测解码、适用于 DSR1/Kimi K2.5 的 Blackwell 上的 TOKENSPEED_MLA、Mooncake 分布式 KV、DeepSeek V4 流水线并行,以及 C++20 + Transformers v5 基线。
@vllm_project: 今天我们很高兴推出vime——一个在vLLM生态系统中用于LLM后训练的简单、稳定且高效的RL框架……
vime是一个用于LLM后训练的新开源RL框架,基于slime的训练设计和vLLM的推理引擎构建,在vLLM生态系统中提供简单、稳定且高效的流水线。