@radixark: SGLang-Diffusion 支持快速、可扩展的多模态生成推理。最新的 VDN-H3 工作使 @MiniMa…
摘要
SGLang-Diffusion 与 MiniMax 的 VDN-H3 支持快速、可扩展的视频生成,在 8× B200 GPU 上,仅需 9.0 秒即可生成 14.4 秒的 768p 视频,实现比实时更快的推理。
查看缓存全文
缓存时间: 2026/09/14 21:34
SGLang-Diffusion为多模态生成提供快速、可扩展的推理能力。最新的VDN-H3集成使@MiniMax_AI H3模型实现了超越实时播放的视频生成速度,并展现出在多GPU环境下优异的扩展能力。👏
SGLang (@sgl_project): 搭载VDN-H3的SGLang-Diffusion现在能在9.0秒内生成14.4秒的768p视频 🚀
在8×B200配置下,仅需6.9秒即可完成8步去噪过程,达到超过2倍实时处理速度。9.0秒的耗时包含了预热后完整的生成请求处理时间。
与致密50步H3模型相比,经测试未发现质量下降
相似文章
加速MiniMax-H3(阅读时间12分钟)
本文基准测试了MiniMax-H3视频生成在8×H200 GPU上使用SGLang Diffusion的加速效果,通过SSIM衡量质量,最高实现6.24倍速度提升。
OpenVDN/vdn-minimax-h3
VDN-Minimax-H3 是一款开源混合注意力模型,能够在几乎无损的质量下加速视频生成,具有快速推理和即插即用适配器的特性,由 MiniMax H3 提供支持。
在TensorSharp中成功运行MiniMax H3视频生成
一位开发者已将MiniMax H3视频生成集成到TensorSharp中,这是一个本地推理引擎,支持图像到视频生成,并突出了LLM、多模态和视频推理在单一运行时中的融合。
@DeRonin_: 这些人搭建了一个无限电影生成机器... @fal 的经过后训练的 Minimax H3 Max 比原版快50倍…
FastVideo 发布了一款开源的、经过后训练的 Minimax H3 模型,它能以50倍的速度生成视频,仅需3秒计算时间即可输出5秒的视频内容,适用于文本到音频视频的生成。
SANA-Video:基于块线性扩散变压器的高效视频生成
SANA-Video是一个小型扩散模型,利用线性注意力和恒定内存KV缓存,高效生成高分辨率、长时长的视频,以显著更低的成本和更快的速度实现与现有模型相媲美的性能。