评估音乐上下文保持:音乐编辑系统的多方面框架
摘要
本文介绍了MuseCPEval,这是一个包含定制化指标的框架,用于评估音乐编辑系统在音色转换和风格转换等任务中保持未改变音乐属性的能力。
查看缓存全文
缓存时间: 2026/08/20 20:05
论文页面 - 评估音乐上下文保持:音乐编辑系统的多维度框架
来源:https://huggingface.co/papers/2512.14629 发布于 8月 18日
·
由 https://huggingface.co/XinXuNLPer 提交
Xin Xu (https://huggingface.co/XinXuNLPer) 于 8月 20日发布
摘要
本研究引入了 MuseCPEval,一个包含定制化指标的框架,用于评估在编辑任务中未改变的音乐属性的保持程度。
音乐编辑 (https://huggingface.co/papers?q=Music%20editing) 在现代音乐制作中扮演着至关重要的角色,广泛应用于电影、广播和游戏开发等领域。音乐编辑 (https://huggingface.co/papers?q=music%20editing) 系统的最新进展使得多种编辑任务成为可能,例如音色迁移 (https://huggingface.co/papers?q=timbre%20transfer)、乐器替换 (https://huggingface.co/papers?q=instrument%20substitution) 和流派转换 (https://huggingface.co/papers?q=genre%20transformation)。然而,许多现有研究忽视了评估其在编辑过程中保持应保持不变的音乐方面的能力,我们将此定义为音乐上下文保持 (https://huggingface.co/papers?q=Music%20Context%20Preservation) (MuseCP (https://huggingface.co/papers?q=MuseCP))。虽然部分研究确实考虑了 MuseCP (https://huggingface.co/papers?q=MuseCP),但其评估协议和指标并不全面。为解决此问题,我们推出了首个 MuseCP (https://huggingface.co/papers?q=MuseCP) 评估框架——MuseCPEval (https://huggingface.co/papers?q=MuseCPEval),该框架涵盖四个类别的音乐方面,采用细粒度且高度定制化的指标来捕捉音乐属性的细微变化。客观验证和人工研究表明了这些指标的有效性。此外,对多样化音乐编辑 (https://huggingface.co/papers?q=music%20editing) 系统进行的案例研究,展示了这些指标作为测试平台和诊断工具的实际效用,为现有系统的优势与局限性提供了见解。我们希望我们的指标和发现能为开发具有强大 MuseCP (https://huggingface.co/papers?q=MuseCP) 能力、更有效可靠的音乐编辑 (https://huggingface.co/papers?q=music%20editing) 策略提供实用指导。
查看 arXiv 页面 (https://arxiv.org/abs/2512.14629) 查看 PDF (https://arxiv.org/pdf/2512.14629) 项目页面 (https://musecpeval-demo.netlify.app/) GitHub (https://github.com/Yashvishe13/MuseCPEval) 添加至收藏 (https://huggingface.co/login?next=%2Fpapers%2F2512.14629)
在您的代理中获取此论文:
hf papers read 2512\.14629
没有最新 CLI?curl \-LsSf https://hf\.co/cli/install\.sh \| bash
引用此论文的模型 0
无模型关联此论文
在模型的 README.md 中引用 arxiv.org/abs/2512.14629 以从此页面链接。
引用此论文的数据集 0
无数据集关联此论文
在数据集的 README.md 中引用 arxiv.org/abs/2512.14629 以从此页面链接。
引用此论文的 Spaces 0
无 Space 关联此论文
在 Space 的 README.md 中引用 arxiv.org/abs/2512.14629 以从此页面链接。
包含此论文的收藏 0
无收藏包含此论文
将此论文添加到收藏 (https://huggingface.co/new-collection) 以从此页面链接。
相似文章
MMAE:一个大规模多任务音频编辑基准
MMAE是一个全面的基于指令的音频编辑基准,涵盖多种模态和复杂度级别,揭示了当前模型能力中的显著差距。
MERIT:学习解耦音乐表示以实现音频相似度
MERIT是一个框架,它通过条件音频生成和源分离音轨学习旋律、节奏和音色的解耦音乐表示,能够进行精细且特定因子的音频相似度查询。
AVE-Compass:迈向音视频编辑能力的全面评估
AVE-Compass 是一个用于全面评估音视频编辑能力的新基准,包含 145 个视频、196 条编辑指令和 2,688 个检查表项。它还提出了 AVE-Agent,一个模块化智能体框架,通过自我反思和评估器反馈改进跨模态编辑。
TuneJury: 一个用于改进音乐生成偏好对齐的开放度量
TuneJury 是一个开源的成对奖励模型,用于文本到音乐生成,提供校准的偏好评分,并泛化到多个下游应用。
迈向大型语言模型的演进上下文参数化
本文介绍了MUSE任务,用于评估大型语言模型中的上下文更新,并提出了PLUME,一种无需训练的方法,在顺序演化设置中显著提升了性能,尤其是在MUSE-Bench基准上。