标签
HeartMuLa是一个用于音乐生成的开源AI模型家族,能够将歌词和标签转换为完整歌曲,包括语言模型、音乐编解码器、歌词转录器和音频文本对齐模型,演示可在Hugging Face Spaces和ModelScope上找到。
我训练了一个1.2B DiT模型用于器乐游戏音乐生成,使用Stable Audio的VAE,旨在覆盖多样化的风格。该项目是开源的,包含一个WebUI和可在HuggingFace上获取的样本。
一个名为TAPEDECK的开源、自托管AI音乐生成电台工具,使用MiniMax Music 3从用户本地GPU上的音乐库创建无限的、个性化电台。
Qwen-Music是一篇新论文,它将音乐生成分为两个阶段:使用紧凑的语义令牌和Melody-CoT进行旋律规划与推理,然后渲染高保真音频,取得了最先进的结果。
Google 发布 Lyria 3 Pro,这是一款先进的音乐生成模型,能够生成最长 3 分钟的音轨,并提供更强的结构控制能力。该模型已集成至 Vertex AI、Google AI Studio、Gemini 和 Google Vids 等多款 Google 产品中。
Google Senior Product Manager Joel Yawili discusses the features and philosophy behind Lyria 3 and Lyria 3 Pro, highlighting improvements in song length, structure control, and multimodal integration with Gemini.