@vllm_project: 迎接 vLLM-Omni v0.22.0,全能模态世界模型与生产级多模态服务的重大升级。首发支持 @NVID…

X AI KOLs Timeline 工具

摘要

vLLM-Omni v0.22.0 是一项重大升级,新增了对 NVIDIA Cosmos 世界模型、生产级 TTS(Qwen3-TTS、Qwen3-Omni、VoxCPM2)的稳健支持,更快的扩散模型服务(Wan 2.2、HunyuanVideo 1.5、LTX-2.3),以及更广泛的量化和硬件覆盖,共包含来自 124 位贡献者的 339 个提交。

欢迎使用 vLLM-Omni v0.22.0,这是面向全能模态世界模型和生产级多模态服务的重大升级。首发支持 @NVIDIAAI Cosmos 3 世界模型:文本、图像、音频、视频与动作的输入及输出。机器人服务:DreamZero + OpenPI 实时 API。生产级 TTS:Qwen3-TTS、Qwen3-Omni、VoxCPM2 等。更快的图像/视频/扩散模型:Wan 2.2、HunyuanVideo 1.5、LTX-2.3。更广泛的量化(FP8/INT8、MXFP4/MXFP8、W4A16、ModelOpt)和硬件覆盖。339 个提交,124 位贡献者,其中 52 位为新贡献者。感谢大家。https://github.com/vllm-project/vllm-omni/releases/tag/v0.22.0…
查看原文
查看缓存全文

缓存时间: 2026/06/08 17:30

为所有人提供简单、快速且便宜的通用多模态模型服务

| 文档 | DeepWiki | 用户论坛 | 开发者 Slack | 微信 | 论文 | 幻灯片 |

相似文章

Lemonade v10.7 发布及项目组织更新

Reddit r/LocalLLaMA

Lemonade v10.7 版本引入了 LMX-Omni 虚拟模型,支持全模态聊天;新增 bench CLI 工具,用于跨后端比较 LLM 性能;并扩展了在 AMD、Apple Silicon、Nvidia 和 Intel 系统上的 GPU 支持。

vllm-project/vllm v0.19.1

GitHub Releases Watchlist

vLLM v0.19.1 发布 - 一个快速易用的开源 LLM 推理和服务库,拥有业界领先的吞吐量,支持 200+ 个模型架构以及包括 NVIDIA/AMD GPU 和 CPU 在内的多样化硬件。

vllm-project/vllm v0.21.0rc1

GitHub Releases Watchlist

vLLM v0.21.0rc1 是高性能大语言模型推理和服务库的预发布更新,主要功能包括针对吞吐量、量化以及硬件支持的优化。