YuE简介
AI/ML
YuE2 是一个开源的音乐生成模型,能够根据用户提供的歌词和风格描述,自动生成包含旋律、和弦、人声与伴奏的完整歌曲。它解决了传统 AI 音乐生成中“黑盒”不可控的问题,通过在生成音频前先生成可编辑的符号化乐谱(ABC 格式),让创作者或 AI Agent 能够在渲染音频前对旋律和和声进行审查与修改。
它在 WildSongBench 基准测试中达到了与 Suno v5/v6 等顶尖商业产品相当的质量水平,同时支持零样本翻唱(将已有录音转录为乐谱后以新风格重新演绎)以及基于对话的交互式音乐编辑,为专业音乐制作和 AI 辅助创作提供了高度可控的开源方案。
亮点特性
01白盒化符号规划
在生成音频前先输出可读、可编辑的 ABC 格式乐谱,实现了对旋律和和弦的精确控制
02前沿生成质量
3B 参数量的开源模型,在 WildSongBench 评测中综合得分超越 Suno v5/v6 等闭源商业模型
03多模态工作流统一
同一个模型权重原生支持从零创作、零样本翻唱到基于 Agent 的交互式编辑三种场景
04完整的生态组件
配套开源了 SOTA 级别的音乐理解模型 MERT2 和音频转乐谱模型 SheetSage2
05Agent 技能集成
提供标准化的 SKILL.md 技能包,可直接让大语言模型调用其进行复杂的音乐迭代编辑
使用场景
场景 1独立音乐人或内容创作者通过输入歌词和风格提示词,快速生成带有完整编曲和人声的歌曲 Demo
场景 2利用 SheetSage2 将现有录音转录为乐谱,结合 YuE2 将其改编为爵士、流行等不同风格的全新翻唱版本
场景 3将 YuE2 作为 Agent Skill 接入大语言模型,通过自然语言对话反复修改歌曲的和声、旋律或配器并实时试听
使用环境
快速上手
环境要求
-
Linux 系统,Python 3.12 -
NVIDIA GPU(需支持 BF16,至少 24GB 显存)
安装步骤
|
命令行快速生成
|
Python API 核心用法
|
核心参数说明
cot="full":默认模式,生成可编辑的旋律与和弦计划后再合成音频 cot="melody":仅使用旋律计划,伴奏自由发挥,推荐用于翻唱 cot="off":跳过乐谱规划,直接从歌词和风格生成音频 abc=...:传入自定义的 ABC 格式乐谱文件进行条件生成
替代方案
对比 1Suno / Udio
目前最流行的商业闭源 AI 音乐生成平台,开箱即用且音质极佳,但无法本地部署,也不支持乐谱级别的白盒编辑
对比 2MusicGen (Meta)
Meta 开源的音乐生成模型,擅长纯乐器音频生成,但不具备 YuE2 的人声合成能力和符号化乐谱规划机制
对比 3ACE-Step
同为开源音乐生成项目,但在 WildSongBench 的综合评测指标上显著低于 YuE2,且缺乏完善的翻唱与 Agent 编辑链路
相关资源
项目地址github.com/multimodal-art-projection/YuE
官网map-yue2.github.io

