我训练了一个游戏音乐生成器
摘要
我训练了一个1.2B DiT模型用于器乐游戏音乐生成,使用Stable Audio的VAE,旨在覆盖多样化的风格。该项目是开源的,包含一个WebUI和可在HuggingFace上获取的样本。
我训练了一个器乐游戏音乐生成器。1.2B DiT在1个云H100上从零开始训练了8天;我使用了Stable Audio 3的VAE。 https://huggingface.co/Localsong/Localsong https://huggingface.co/Localsong/Localsong/tree/main/samples https://huggingface.co/Localsong/Localsong/blob/main/samples_new/The%20First%20Climb.mp3 我的目标是覆盖比Ace-Step、Minimax M3或Stable Audio 3更广泛的器乐风格。(无歌词)该仓库包含一个WebUI和一些MP3样本 - 克隆它并运行uv run webui.py 请告诉我您的想法。
相似文章
最佳本地AI音乐生成器来了!免费无限制
ACE-Step 1.5 XL是一款开源音乐生成器,在质量与速度上超越Suno与Udio,仅需12 GB GPU即可无限运行,生成速度约120×实时。
如何在仅有6GB显存的旧Linux桌面电脑上训练生成式AI底鼓模型
本指南介绍如何利用仅有6GB显存的旧Linux桌面电脑训练生成式AI底鼓音效模型,让AI音频生成在有限硬件条件下变得触手可及。
@thepatch_kev:有些AI音乐模型实际上是专为音乐人打造的,Stable Audio 3就是一个很好的例子。感谢 @z…
Stability AI 发布了 Stable Audio 3.0,这是一个用于生成音频的开放权重模型系列,旨在支持艺术实验并集成到 gary4juce 等 DAW 中。
通过人类偏好奖励改进文本到音乐生成
本文提出了一种文本到音乐生成系统,利用奖励条件、专家迭代和偏好调优,在120M参数模型中提升音频质量,该模型提交至ICME 2026 ATTM Grand Challenge。
Stability AI 发布新音频模型,可生成6分钟歌曲
Stability AI 发布 Stability Audio 3.0,这是一系列音频模型,能够生成长达6分钟的专业级音乐,其中包含较小模型的开放权重版本以及许可训练数据。