@radixark: SGLang-Diffusion 支持快速、可扩展的多模态生成推理。最新的 VDN-H3 工作使 @MiniMa…

X AI KOLs Timeline 工具

摘要

SGLang-Diffusion 与 MiniMax 的 VDN-H3 支持快速、可扩展的视频生成,在 8× B200 GPU 上,仅需 9.0 秒即可生成 14.4 秒的 768p 视频,实现比实时更快的推理。

SGLang-Diffusion 支持快速、可扩展的多模态生成推理。最新的 VDN-H3 工作使 @MiniMax_AI H3 实现比播放更快的视频生成,并在多个 GPU 上实现强大扩展。 👏
查看原文
查看缓存全文

缓存时间: 2026/09/14 21:34

SGLang-Diffusion为多模态生成提供快速、可扩展的推理能力。最新的VDN-H3集成使@MiniMax_AI H3模型实现了超越实时播放的视频生成速度,并展现出在多GPU环境下优异的扩展能力。👏

SGLang (@sgl_project): 搭载VDN-H3的SGLang-Diffusion现在能在9.0秒内生成14.4秒的768p视频 🚀

在8×B200配置下,仅需6.9秒即可完成8步去噪过程,达到超过2倍实时处理速度。9.0秒的耗时包含了预热后完整的生成请求处理时间。

与致密50步H3模型相比,经测试未发现质量下降

相似文章

加速MiniMax-H3(阅读时间12分钟)

TLDR AI

本文基准测试了MiniMax-H3视频生成在8×H200 GPU上使用SGLang Diffusion的加速效果,通过SSIM衡量质量,最高实现6.24倍速度提升。

OpenVDN/vdn-minimax-h3

Hugging Face Models Trending

VDN-Minimax-H3 是一款开源混合注意力模型,能够在几乎无损的质量下加速视频生成,具有快速推理和即插即用适配器的特性,由 MiniMax H3 提供支持。

在TensorSharp中成功运行MiniMax H3视频生成

Reddit r/LocalLLaMA

一位开发者已将MiniMax H3视频生成集成到TensorSharp中,这是一个本地推理引擎,支持图像到视频生成,并突出了LLM、多模态和视频推理在单一运行时中的融合。