新模型 2026-09-11

开源音乐模型 YuE2-3B 发布:先写可编辑乐谱再生成整曲,号称媲美 Suno v5

开源音乐模型 YuE2-3B 发布:先写可编辑乐谱再生成整曲,号称媲美 Suno v5

发生了什么

9 月 9 日(报道集中于 9 月 11 日),香港科技大学与 Multimodal Art Projection(M·A·P)团队开源了音乐生成模型 YuE2-3B(约 30 亿参数)。它和 Suno、Udio 最大的不同是“白盒”做法:给一句歌词和风格描述后,模型先写出一份可编辑的乐谱(ABC 记谱法写的旋律 + 和弦),你人看过、改过之后,它再把乐谱渲染成一首最长 5 分钟、48kHz 立体声、带人声和伴奏的完整歌曲。

权重已在 Hugging Face 放出(CC BY-NC 4.0,非商用),代码在 GitHub(Apache 2.0)。在 WildSongBench 公开基准(192 条Prompt)上,YuE2 best-of-8 得分 6.96,略高于 Suno v5(6.87)和 Mureka 9(6.94)。一张 24GB 显存的消费级显卡(如 RTX 4090)就能本地跑,输出 48kHz 立体声,支持中英文。

对我有什么用

过去做 AI 音乐基本是“黑盒”:你丢一句提示词,模型直接吐音频,中间旋律对不对你改不了,只能整首重生成。YuE2 把“作曲”和“演唱/制作”拆开——先出乐谱,人能介入改和弦、移调、调旋律,再渲染。这等于把可控性还给了创作者,也第一次让“看乐谱学 AI 作曲”成为可能。对开源阵营来说,24GB 显卡就能本地跑、质量逼近商业闭源产品,是缩小和 Suno 差距的重要一步。

我可以怎么做

  • 做歌 / 写 demo:在 Hugging Face 或 demo 页(map-yue2.github.io)输入歌词 + 风格,就能生成带人声的完整歌曲,不用懂乐理也能出成品。
  • 学音乐 / 教学:老师可以生成一首歌,把乐谱投出来和学生讲和弦走向,直观又好懂。
  • 本地玩:有 24GB 显卡的玩家可以本机部署,数据不出本机,隐私更好;支持“翻唱”(给一段录音重新编曲)和“对话式编辑”(跟模型聊着改歌)。

温馨提醒

  • 商用受限:权重和代码都是非商业许可,想拿来做付费产品、商用的要先确认授权,别直接拿去卖。
  • 听感还需社区验证:超过 Suno v5 的说法主要来自发布方自测和个别用户反馈,独立大规模横评还少,实际效果建议你先听官方 demo 再判断。
  • 它需要一定显卡门槛(约 24GB 显存),纯 CPU 或低显存机器跑不动。
📤 一键转发小助手 帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发