@songhan_mit: 探索SANA World Model,采用混合线性注意力,高效且快速!
摘要
SANA World Model是一个新的人工智能模型,采用混合线性注意力,以实现高效和快速。
探索SANA World Model,采用混合线性注意力,高效且快速!
相似文章
@songhan_mit: SANA world model的因果版本已发布,使得在单个H100上实现接近实时推理:
SANA世界模型的因果版本已发布,可在单个H100 GPU上实现接近实时的视频生成推理,并附带开源代码和演示。
SANA-Video 2.0:基于混合线性注意力和注意力残差的高效视频生成
SANA-Video 2.0 为视频扩散Transformer引入了混合线性-softmax注意力机制,可在单个GPU上生成高达720p的高质量视频,与全softmax模型相比显著降低延迟,同时保持具有竞争力的VBench分数。
SANA-WM: 高效分钟级世界建模与混合线性扩散Transformer
SANA-WM是一个拥有26亿参数的开源世界模型,能生成高保真720p分钟级视频,支持精确相机控制,在达到工业级质量的同时显著降低计算需求。
Efficient-Large-Model/SANA-WM_bidirectional
SANA-WM 是一个高效的 2.6B 参数开源世界模型,用于分钟级视频生成并具备精确的相机控制。它采用混合线性扩散变换器和两阶段流水线,从图像和文本提示生成 720p 视频。
SANA-Video:基于块线性扩散变压器的高效视频生成
SANA-Video是一个小型扩散模型,利用线性注意力和恒定内存KV缓存,高效生成高分辨率、长时长的视频,以显著更低的成本和更快的速度实现与现有模型相媲美的性能。