@multimodalart: @StabilityAI 的 Stable Audio 3 刚刚发布。主要提供3种开源变体:- Stable Audio 3 Medium (2B) - …

X AI KOLs Following 模型

摘要

Stability AI发布了Stable Audio 3,提供用于音乐和VFX的开源变体,具备快速且高质量的音频生成能力。

Stable Audio 3 by @StabilityAI 刚刚发布 主要提供3种开源变体: - Stable Audio 3 Medium (2B) - Stable Audio 3 Small (0.6B) - 音乐 - Stable Audio 3 Small (0.6B) - VFX (和一个"large"的闭源变体) 这些开放模型速度极快且质量很高 https://t.co/j4y7qoXjqs
查看原文
查看缓存全文

缓存时间: 2026/05/21 13:32

Stable Audio 3 由 @StabilityAI 发布

主要提供三个开源版本:

  • Stable Audio 3 Medium (2B)
  • Stable Audio 3 Small (0.6B) - 音乐
  • Stable Audio 3 Small (0.6B) - VFX (以及一个“大型“闭源版本)

这些开源模型速度快且质量高 https://t.co/j4y7qoXjqs

相似文章

Stable Audio 3.0(3分钟阅读)

TLDR AI

Stability AI发布了Stable Audio 3.0,这是一个开放权重模型系列,可生成最长六分钟的变长音频,支持LoRA微调和音频修复,基于完全许可的数据训练。

stabilityai/stable-audio-3-medium

Hugging Face Models Trending

Stability AI 发布了 Stable Audio 3,这是一个潜在扩散模型系列,用于可变长度音频生成和编辑,其小型和中型模型的权重已在 Hugging Face 上提供。

Stable Audio 3

Hacker News Top

Stable Audio 3 推出了一系列快速潜扩散模型,用于变长音频生成与编辑,并开源了中小型模型权重。