@honualx: 音乐缺少了自己的“openai-whisper”。是时候让我们可以把任何音乐转成音符,就像语音转写现在已经成为理所当然的事情一样。
摘要
Kyutai 发布了 MuScriptor,这是一个用于多乐器转录的开源模型,能将任何音乐录音转换为 MIDI 音符,类似于 OpenAI Whisper 对语音的处理。
查看缓存全文
缓存时间: 2026/07/12 23:03
音乐领域缺少一个“OpenAI-Whisper“。是时候让我们像语音转录那样轻松地将任意音乐转换为乐谱了。我们做到了吗?在测试MuScriptor之后告诉我们吧 🎶 由@simonrouard(@kyutai_labs, @Ircam)和Michael Krause(@MireloAI)共同完成。
kyutai(@kyutai_labs): 我们发布了MuScriptor,这是迄今为止最好的多乐器转录开源模型,是与@MireloAI合作创建的。 给它任何流派的录音:流行、古典、金属、爵士,任何都可以,它就能将各个乐器转录为MIDI。链接在🧵中。
相似文章
@kyutai_labs: 我们发布了 MuScriptor,迄今最佳的多乐器转录开源模型,由我们与 @MireloAI 合作开发。
Kyutai Labs 与 MireloAI 发布了 MuScriptor,这是迄今最佳的多乐器转录开源模型,能够将任意流派的录音转录为各乐器的 MIDI 音轨。
MuScriptor:一个用于多乐器音乐转录的开放模型
MuScriptor 是一个开源的多乐器音乐转录模型,能够将录音转录为每种乐器的 MIDI 音符,无需事先知道存在的乐器。
@MireloAI: 今天,我们与@kyutai_labs合作,推出了全新的Audio-to-MIDI模型。它能接收完整的录音,并识别…
Mirelo AI与Kyutai Labs合作,推出了一款开源的Audio-to-MIDI模型,该模型能将完整的音乐混音转录为每个乐器的单独MIDI音轨,并直接从混音中检测和弦、调性和节奏,无需分离的音轨。
@askalphaxiv: “Qwen-Music技术报告” AI音乐生成需要同时解决两个问题:创作连贯的歌曲并渲染…
Qwen-Music是一篇新论文,它将音乐生成分为两个阶段:使用紧凑的语义令牌和Melody-CoT进行旋律规划与推理,然后渲染高保真音频,取得了最先进的结果。
@honualx: 如果你曾希望 @suno 为音乐制作提供更精细的控制,现在你可以将其歌曲通过 MuScriptor 传输并导入…
MuScriptor 可以将 Suno AI 的歌曲转换为 MIDI 文件,从而实现更精细的控制,并导入到像 FL Studio 这样的数字音频工作站中。