我认为 Suno v6 听起来真棒。这是我对 Suno 目前状态的真实感受,而不是声称每次生成都胜过人类制作,或所有人都同意我的看法。
更有意思的问题是:我们是如何走到这一步的?经过几代模型,Suno 已经从生成短歌曲,发展到一种可以要求它修改曲目中特定部分的工作流。与此同时,开发者也在发布带有可下载权重和编辑工具的本地音乐模型,并且目标越来越认真。
我喜欢目前从 Suno 中听到的声音。我也想了解我们获得了多少控制权、放弃了什么,以及开源替代方案能否融入制作人的工作流。本文将个人观点与发布历史、已公布的评测和有出处的反应结合起来。本文并不是我对所有这些模型进行的受控试听测试。
Suno 是如何发展到 v6 的?
与其把 Suno 的历史看成更大版本号的连续升级,不如把它理解为控制能力逐步增强的过程。以下是精选的里程碑,并非涵盖每一次发布。
2023 年 12 月: Microsoft 的 Copilot 集成将 Suno 的文本生成歌曲功能带入了大型消费者助手。Copilot 的 Suno 集成。
2024 年 3 月 21 日:v3 让短歌曲变得触手可及。 Suno 向所有用户发布了 v3,可以生成完整的两分钟歌曲。公司强调了音频质量、更广泛的风格以及更好的提示词遵循能力,同时也承认质量、控制力和速度仍需改进。Suno 的 v3 公告。
2024 年 11 月 19 日:v4 增加了重新探索创意的方式。 Suno 推出了 Remaster 和 ReMi 歌词助手,同时更新了 Covers 和 Personas。创作者可以重新制作早期曲目,或将其音乐身份中的某些元素带入另一次生成。Suno 表示,此次更新的目标包括更干净的声音和更具动态感的结构。Suno 的 v4 公告。
2025 年 5 月 1 日:v4.5 专注于表现力和提示词。 Suno 宣传了更丰富的人声、更准确的曲风、更细致的器乐质感以及更快的生成速度。其提示词助手可以扩展简单描述,而 Covers 则旨在保留更多旋律细节。这些是公司的发布声明,并不是我复现的测量结果。v4.5 提升创作力。
2025 年 9 月 23 日:v5 推进了音频和创作控制。 Suno 强调了人声自然度、曲风处理能力,以及重新制作旧曲目时的变化控制。Suno:介绍 v5。
2026 年 3 月 26 日:v5.5 让个性化更加明确。 Voices、Custom Models 和 My Taste 同时推出。Suno 表示,用户可以使用至少六首曲目训练个性化模型,将自己的声音带入创作,并让系统学习个人偏好。介绍 v5.5:Voices、Custom Models 和 My Taste。
2026 年 9 月 9 日:v6 成为一个模型家族。 Suno 推出了三个变体,并宣布随着新一代模型上线,将停止使用早期模型。它还将 v6 描述为与 Warner Music Group、BMG 和 Believe 的合作成果。Suno 的 v6 公告。
从这些发布中,我看到了一个清晰的转变:创作者越来越希望保留喜欢的部分,修改不喜欢的部分。第一次生成出好结果很重要。但当你开始制作一首真正关心的曲目时,能够继续发展它更加重要。
Suno v6、Wild 和 Mini:有什么不同?
Suno 根据不同的创作目标来定位这三个模型。这些名称并不代表三个必然对应不同音乐品味的等级。
| 模型 | Suno 设定的用途 | 访问权限 |
|---|---|---|
| v6 | 为明确的音乐需求提供更可预测的起点 | Pro 和 Premier |
| v6-wild | 探索、曲风融合以及更不可预测的选择 | Pro 和 Premier |
| v6-mini | 更快速、更轻量地生成,用于尝试创意 | 所有套餐,包括 Free |
Suno 的帮助页面表示,三个模型都支持每次生成最长八分钟。这是时长上限,并不保证每个输出都会有八分钟,或能让你持续关注八分钟。v6 有什么新功能?。
我的初步使用方式会是:用 Mini 勾勒草稿;当创意需要不同方向时尝试 Wild;当我有更明确的需求时使用 v6。这是基于官方文档中各模型定位的工作流建议,并不是声称我用完全相同的提示词测试过三者。

官方发布艺术图:Suno,2026 年 9 月。该插图用于标识此次发布,并不是基准测试结果,也不是我的使用截图。
真正重要的变化:编辑歌曲
v6 的发布说明介绍了通过自然语言进行段落级修改、无需重建整首歌曲即可修正歌词、从多个来源制作混音,以及分离某个元素并将其发展成新内容的采样工作流。它还接受文本之外的起始素材,包括音频和视觉输入。Suno 的 v6 创作与编辑说明。
相比“模型在每种曲风中听起来都更好”这样的说法,这些能力更让我感兴趣。一个副歌可能已经很好。主歌可能需要不同的人声处理。重新开始可能会丢失最初让你想保留这首曲目的东西。
我会从保留效果来评判这些编辑工具:要求的修改是否发生了?我想保留的段落是否还在?一首令人信服的重新生成歌曲很有用,但它与精确编辑是两回事。Suno 的功能描述并不能证明每次都能做到完美保留。
对于制作人来说,下一步仍然需要聆听和做决定。生成的编曲可能需要 EQ、自动化、编辑或替换部分,才能符合你自己的声音。我的按类别整理的 VST plugin 推荐介绍了完成这些工作的工具。
其他创作者如何评价 v6?
这些反应并没有整齐地与我的积极印象一致。
Moe Lueker 给出了总体积极的比较结果。 在 9 月 19 日发布的一次演示中,他描述了使用重复提示词和设置生成的大约 150 首歌曲。他更喜欢 v6 更饱满、更完整的结果,认为 Wild 能带来有用的意外方向,并认为 Mini 是可行的起草选项。他还披露了提前体验权限、与 Suno 的合作关系以及联盟链接。这些背景应当与赞扬一起考虑。Moe 对 v6、Wild 和 Mini 的比较。
一位 Reddit 测试者称赞了保真度,但在特定曲风上遇到困难。 “V6 and Wild: Initial thoughts”的作者报告称进行了大约 50 次生成,喜欢其声音,但发现它对包括 UK garage 和 liquid drum and bass 在内的风格遵循能力较弱。这是一位用户的体验,并不能证明整个曲风都无法正常工作。V6 and Wild:初步想法。
其他用户则认为出现了退步。 在另一个讨论帖中,原帖作者抱怨声音变得更沉闷、人声身份不稳定,以及熟悉的提示词生成出更加普通的结果。回复中既有赞同,也有反对。Suno v6 感觉像是大幅降级。
我可以认为 Suno 听起来很棒,同时仍然认真对待这些批评。精致的混音、准确的曲风、独特的人声和有用的意外是不同的事情。这些讨论都不是具有代表性的调查,我也不会把它们换算成满意用户的百分比。
值得关注的四个开源和开放权重替代方案
本地模型吸引我的地方在于,开发者可以围绕它们构建工具、保留特定检查点,并选择自己的工作流。不过,设置、硬件和许可可能会让这种自由付出大量时间成本。
这里也需要谨慎使用“开源”这个词。下面三个项目发布了宽松许可证;YuE2 则将其开源代码与限制更严格的模型权重条款分开。这是一份实用的候选清单,并不是经过测量的受欢迎程度排名。
1. ACE-Step 1.5 及其 XL 模型
ACE-Step 1.5 是我最先想研究的本地制作工作流候选方案。其文档列出的能力包括基于歌词条件的生成、参考音频、翻唱、选择性重绘以及 LoRA 个性化。该项目采用 MIT 许可证。
其 2026 年 4 月发布的 XL 版本增加了更大的 4B diffusion decoder。维护者说明,启用 offloading 至少需要 12 GB VRAM,并建议至少 20 GB。更小的配置有不同要求;“可以本地运行”并不意味着每个检查点都能装进每台笔记本电脑。
我对它的编辑和集成选项很感兴趣。在相信任何醒目的速度宣传之前,我会先测试实际硬件配置。该项目与商业模型的比较是项目自身的说法,并不是独立的 v6 结论。
2. HeartMuLa
HeartMuLa 将歌曲生成与相关音乐工具结合起来,包括 codec 和歌词转录功能。维护者推荐其 2026 年 2 月发布的 3B 版本用于生成,并表示代码仓库及相关权重采用 Apache 2.0。
我会将它列入歌词驱动实验和多语言素材的候选清单。相比单首演示歌曲,它周边的工具链同样让我感兴趣。这是值得研究的理由,并不是我对其人声质量的个人评估。
3. DiffRhythm 2
DiffRhythm 2 通过半自回归 diffusion 架构,针对带有对齐歌词的完整歌曲生成。该代码仓库明确表示,代码和权重均采用 Apache 2.0 许可证。
它提供推理脚本和参考音频示例,但一些便利功能仍在 TODO 列表中。我将它视为一个有用的研究和集成候选方案,而不是 Suno 浏览器体验的现成替代品。如果你想今晚就制作音乐,而不是维护一个 Python 环境,这一区别很重要。
4. YuE2:一个需要注意许可区别的新版本
YuE2 于 2026 年 9 月发布,在生成音频之前先生成可编辑的旋律与和弦计划。这种方式为开发者提供了不同的作曲干预位置。
它的代码采用 Apache 2.0。模型权重采用 CC BY-NC 4.0,并附带额外的创作者权限。项目允许个人创作者和音乐人根据这些条款将输出用于商业化,而企业则需要讨论商业模型许可证。请阅读实际模型许可证,不要只看代码仓库的许可证徽章。
我认为可编辑的作曲过程尤其有趣。我并不是把 YuE2 描述成不受限制的商业后端,也没有声称它重新生成的音频能够保留完全相同的演奏。
已公布的基准测试显示了什么?
YuE2 团队的 WildSongBench 比较评估了 192 个提示词。以下是其已公布数据中的部分结果,使用的是标准 YuE2,而不是单独的 best-of-eight 设置。

| 评估系统 | SongBench 平均分,越高越好 | 音素错误率,越低越好 |
|---|---|---|
| Suno v5.5 | 6.7150 | 5.96% |
| Suno v6 | 6.5562 | 7.58% |
| Suno v6 Wild | 6.4195 | 7.45% |
| YuE2 | 6.7316 | 8.44% |
| HeartMuLa | 6.2483 | 10.71% |
| ACE-Step 1.5 | 6.0118 | 7.46% |
| DiffRhythm 2 | 5.2428 | 18.41% |
SongBench 是一种自动质量评估器。音素错误率衡量歌词转录错误;它并不是衡量你是否喜欢这首歌的分数。不同指标会偏向不同系统。
这些是开发者发布的系统比较,包含候选结果筛选和不同的生成协议,并不是计算资源相同的测试,也不是独立听众投票。应将其视为 9 月 12 日的快照,而不是后续更新的评分。数据并不能证明存在统计显著的优越性。它也说明了为什么“更新的总是更好”过于笼统:在这两个指标上,v5.5 的分数高于 v6,尽管我现在对 Suno 的印象很好。YuE 基准测试结果与评估范围,完整精度结果。
权利问题仍然是这段历史的一部分
2024 年针对 Suno 的版权诉讼指控其未经授权复制录音用于训练。这是法庭文件中的指控,并不是我可以通过聆听生成歌曲来确认的结论。已提交的诉状。
v6 的行业合作代表了 Suno 所宣称方法的变化,但并没有解决所有争议。MusicRadar 于 2026 年 9 月 22 日报道了 Universal 和 Sony 针对 v6 提出的进一步指控。Universal 和 Sony 关于 Suno v6 的指控。
Suno 当前的条款还将免费层的个人、非商业使用,与付费层有条件的商业使用区分开来,其中包括允许下载的要求。它们并不保证输出内容一定拥有版权。上传权利、混音规则以及你的发行平台政策仍然很重要。Suno 服务条款。
我的看法:声音越好,控制力就越有价值
我现在对 Suno 的声音持积极态度。我希望利用这种进步来发展创意、比较编曲,并尝试那些原本可能半途而废的方向。我不需要假装每个结果都是完成版唱片,才能认为它有用。
下一次比较时,我会固定歌词和需求,在匹配响度下聆听,并将第一印象与可编辑性分开评估。我还会统计失败次数和设置时间。一个偶尔能生成精彩歌曲的工具,在截止日期临近时仍然可能很难使用。
Suno 为我提供了一个方便的探索场所。ACE-Step 和其他本地项目则让我有理由跳出单一托管服务进行研究。我的上一篇关于 AI 与音乐制作的文章讨论了这种更广泛的关系;近期发布的模型让进一步研究变得更加实际。
我喜欢目前听到的声音。现在,我希望工具能让我对那些值得保留的部分做更多事情。
---
