text-to-music

标签

Cards List
#text-to-music

新音乐生成模型YuE2-3B发布!

Reddit r/LocalLLaMA · 2026-09-11 缓存

YuE2-3B是一个开源的音乐生成模型,能够根据歌词和风格提示创作完整的歌曲,具有可编辑的乐谱功能,其性能达到业界领先水平,媲美Suno v5等商业模型。

0 人收藏 0 人点赞
#text-to-music

MiniMax-Music3 发布!

Reddit r/LocalLLaMA · 2026-08-13 缓存

MiniMax 发布 Music 3,一款高性能音乐生成模型,可根据歌词和详细描述生成最长五分钟的完整歌曲,配备 8B 全局大语言模型和 0.6B 局部大语言模型,以实现长程连贯性和声学细节。

0 人收藏 0 人点赞
#text-to-music

面向设备上语义音频生成的量化原生运行时

Hugging Face Daily Papers · 2026-07-09 缓存

本文提出一种无依赖的原生运行时,通过量化和激活引导,在嵌入式设备上实现高效的文本到音乐生成。在8位精度下,实现了无测量质量损失,并使1.2B参数模型能够在 Raspberry Pi 5 上以4位精度运行。

0 人收藏 0 人点赞
#text-to-music

通过人类偏好奖励改进文本到音乐生成

Hugging Face Daily Papers · 2026-06-19 缓存

本文提出了一种文本到音乐生成系统,利用奖励条件、专家迭代和偏好调优,在120M参数模型中提升音频质量,该模型提交至ICME 2026 ATTM Grand Challenge。

0 人收藏 0 人点赞
#text-to-music

TuneJury: 一个用于改进音乐生成偏好对齐的开放度量

Hugging Face Daily Papers · 2026-06-15 缓存

TuneJury 是一个开源的成对奖励模型,用于文本到音乐生成,提供校准的偏好评分,并泛化到多个下游应用。

0 人收藏 0 人点赞
#text-to-music

Mental Damage:针对检索增强文本到音乐生成的描述投毒攻击

arXiv cs.AI · 2026-06-01 缓存

本文介绍了一种针对检索增强文本到音乐系统的双层描述投毒攻击,证明攻击者可以通过向知识数据库中注入恶意描述,在不修改用户提示或模型的情况下,将生成的音乐引导至攻击者选择的意图。

0 人收藏 0 人点赞
#text-to-music

@junmingong: Khala 1.0 刚刚发布——来自北京中央音乐学院的一个音乐生成模型。论文、代码、权重……

X AI KOLs Timeline · 2026-05-16 缓存

Khala 1.0 是一个开源音乐生成模型,用于从文本和歌词生成高保真完整歌曲,采用统一的声学标记管道。由北京中央音乐学院发布,附带论文、代码、权重和演示。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈