@Aayush__Saini_:加入@vllm_project-sr项目担任主要维护者,与来自Meta、Google和AMD的团队合作 : ) 来自印度的首位……
摘要
Aayush Saini 已加入 vLLM 项目担任主要维护者,成为 vLLM 社区中来自印度的首位人士,与来自 Meta、Google 和 AMD 的团队合作。
加入@vllm_project-sr项目担任主要维护者,与来自Meta、Google和AMD的团队合作 : )
vLLM中来自印度的首位人士:)
#vllm #OpenSource https://t.co/2fb5YdNyaw
查看缓存全文
缓存时间: 2026/08/25 14:06
在 @vllm_project-sr 项目中加入Meta、Google和AMD的伙伴们,担任首席维护员:)
vLLM项目首位来自印度的贡献者:)
#vLLM #开源 https://t.co/2fb5YdNyaw
相似文章
@vllm_project: vLLM v0.21.0 发布!367 次提交,来自 202 位贡献者(其中 49 位新贡献者)。亮点:KV 卸载 + HMA、带思考预算的推测解码(适用于推理模型)……
vLLM v0.21.0 已发布,新增 KV 卸载 + HMA、面向推理模型的带思考预算的推测解码、适用于 DSR1/Kimi K2.5 的 Blackwell 上的 TOKENSPEED_MLA、Mooncake 分布式 KV、DeepSeek V4 流水线并行,以及 C++20 + Transformers v5 基线。
@amitiitbhu:新文章:vLLM 是如何工作的?请在此阅读:https://outcomeschool.com/blog/how-does-vllm-work…
一篇详细的博客文章,解释了 vLLM 的工作原理,包括 PagedAttention、KV 缓存管理和连续批处理,以实现高效的 LLM 服务。
@bibryam: 我作为高级工程师在2026年如何使用LLMs https://seangoedecke.com/how-i-use-llms-in-2026… 最大的AI工作流变化…
一位高级工程师描述了到2026年LLM代理如何演变成编码、调试和代码库研究的可靠协作者,而人类仍负责判断和审查。
@vllm_project: Rust 前端现已正式合并至 vLLM!随着 GPU 性能不断提升,前端已占据相当比例的 CPU 时间。…
vLLM 的 Rust 前端现已正式合并,可作为 Python API 服务器的直接替代方案,在预处理密集型工作负载上吞吐量提升高达 5 倍。
@RedHat_AI: Michael Goin (@mgoin_) 详解 @vllm_project v0.20.0。752 次提交。320 位贡献者。123 位新贡献者。DeepSeek V4, TurboQ…
Michael Goin 回顾了 vLLM v0.20.0 的发布,重点介绍了 752 次代码提交以及新功能,包括对 DeepSeek V4 的支持、TurboQuant 技术以及 PyTorch 2.11 的集成。