Je trouve que Suno v6 sonne vraiment très bien. C’est ma réaction honnête face à l’état actuel de Suno, et non l’affirmation que chaque génération surpasse une production humaine ou que tout le monde est d’accord avec moi.
La question la plus intéressante est de savoir comment nous en sommes arrivés là. En quelques générations de modèles, Suno est passé de courtes chansons générées à un workflow dans lequel vous pouvez demander des modifications sur des parties précises d’un morceau. Pendant ce temps, des développeurs publient des modèles de musique locaux avec des poids téléchargeables, des outils d’édition et des ambitions de plus en plus sérieuses.
J’aime le son que j’entends avec Suno. Je veux aussi comprendre quel degré de contrôle nous gagnons, ce que nous abandonnons et si les alternatives open source peuvent s’intégrer au workflow d’un producteur. Cet article combine ce point de vue personnel avec l’historique des versions, des évaluations publiées et des réactions attribuées. Il ne s’agit pas de mon propre test d’écoute contrôlé de tous ces modèles.
Comment Suno en est-il arrivé à v6 ?
L’histoire de Suno prend davantage sens comme une progression du contrôle que comme une succession de numéros de version toujours plus élevés. Voici quelques étapes importantes, et non la liste de toutes les sorties.
Décembre 2023 : l’intégration de Suno à Microsoft Copilot a introduit la génération de chansons à partir de texte de Suno dans un assistant grand public majeur. L’intégration de Suno à Copilot.
21 mars 2024 : v3 a rendu les chansons courtes accessibles. Suno a lancé v3 pour tous les utilisateurs, avec la génération de chansons complètes de deux minutes. L’entreprise a mis en avant la qualité audio, une plus grande variété de styles et une meilleure compréhension des prompts. Elle a également reconnu que la qualité, le contrôle et la vitesse nécessitaient encore des améliorations. L’annonce de v3 par Suno.
19 novembre 2024 : v4 a ajouté des moyens de revisiter une idée. Suno a introduit Remaster et l’assistant de paroles ReMi, ainsi que des mises à jour de Covers et Personas. Un créateur pouvait retravailler un morceau précédent ou transférer certains éléments de son identité vers une autre génération. Suno a présenté un son plus propre et des structures plus dynamiques comme objectifs de cette mise à jour. L’annonce de v4 par Suno.
1er mai 2025 : v4.5 s’est concentrée sur l’expression et le prompting. Suno a annoncé des voix plus riches, des genres plus précis, des textures instrumentales plus détaillées et une génération plus rapide. Son assistant de prompts développait les descriptions simples, tandis que Covers cherchait à conserver davantage de détails mélodiques. Ce sont les affirmations de l’entreprise concernant la sortie, et non des mesures que j’ai reproduites. v4.5 améliore la créativité.
23 septembre 2025 : v5 a renforcé l’audio et le contrôle créatif. Suno a mis l’accent sur le naturel des voix, la gestion des genres et les contrôles de variation pour le remastering des anciens morceaux. Suno : présentation de v5.
26 mars 2026 : v5.5 a rendu la personnalisation plus explicite. Voices, Custom Models et My Taste sont arrivés ensemble. Suno a décrit l’entraînement d’un modèle personnalisé à partir d’au moins six morceaux, l’intégration de votre propre voix dans les créations et l’apprentissage de vos préférences. Présentation de v5.5 : Voices, Custom Models et My Taste.
9 septembre 2026 : v6 est devenue une famille. Suno a lancé trois variantes et annoncé le retrait des modèles précédents en passant à la nouvelle génération. L’entreprise a également présenté v6 comme une collaboration avec Warner Music Group, BMG et Believe. L’annonce de v6 par Suno.
Je constate une évolution claire à travers ces sorties : les créateurs veulent de plus en plus conserver la partie qui leur plaît et modifier celle qui ne leur plaît pas. Un bon premier résultat compte. Pouvoir le développer compte davantage dès que vous commencez à créer un morceau auquel vous tenez.
Suno v6 vs Wild vs Mini : quelles sont les différences ?
Suno positionne les trois modèles autour d’objectifs créatifs différents. Les noms ne décrivent pas trois niveaux garantis de goût musical.
| Modèle | Rôle prévu par Suno | Accès |
|---|---|---|
| v6 | Un point de départ plus prévisible pour un brief musical défini | Pro et Premier |
| v6-wild | Exploration, mélange des genres et choix moins prévisibles | Pro et Premier |
| v6-mini | Génération plus rapide et plus légère pour tester des idées | Tous les forfaits, y compris Free |
La page d’aide de Suno indique que les trois modèles prennent en charge jusqu’à huit minutes par génération. Il s’agit d’une limite de durée, et non de la garantie que chaque résultat durera huit minutes ou retiendra votre attention pendant huit minutes. Quoi de neuf dans v6 ?.
Mon approche initiale serait d’esquisser avec Mini, d’essayer Wild lorsqu’une idée a besoin d’une direction différente et d’utiliser v6 lorsque mon brief est plus précis. Il s’agit d’une suggestion de workflow fondée sur leurs rôles documentés, et non de l’affirmation que j’ai testé des prompts identiques sur les trois modèles.

Illustration officielle du lancement : Suno, septembre 2026. L’illustration identifie la sortie ; il ne s’agit ni d’un benchmark ni d’une capture d’écran de ma session.
Le changement qui compte : éditer la chanson
Le lancement de v6 décrit les modifications au niveau des sections en langage naturel, les corrections de paroles sans reconstruire toute une chanson, les mashups à partir de plusieurs sources et les workflows d’échantillonnage qui isolent un élément pour le développer en quelque chose de nouveau. Le modèle accepte également des éléments de départ autres que du texte, notamment des entrées audio et visuelles. Notes de Suno sur la création et l’édition avec v6.
Ces capacités m’intéressent davantage que l’affirmation selon laquelle un modèle sonne mieux dans tous les genres. Un hook peut déjà fonctionner. Le refrain peut nécessiter un traitement vocal différent. Recommencer risque de faire perdre ce qui vous donnait envie de conserver le morceau.
J’évaluerais ces outils d’édition sur leur capacité de préservation : la modification demandée a-t-elle été effectuée, et les sections que je voulais conserver ont-elles survécu ? Une chanson régénérée de manière convaincante est utile, mais cela diffère d’une édition précise. La description des fonctionnalités de Suno ne prouve pas une préservation parfaite dans tous les cas.
Pour un producteur, l’étape suivante implique toujours de l’écoute et des décisions. Un arrangement généré peut nécessiter de l’EQ, de l’automation, de l’édition ou des parties de remplacement avant de correspondre à votre propre son. Mes sélections de plugins VST par catégorie couvrent des outils pour ce travail de finition.
Que disent les autres créateurs de v6 ?
Les réactions ne correspondent pas parfaitement à mon impression positive.
Moe Lueker fait état d’une comparaison globalement positive. Dans une présentation du 19 septembre, il décrit environ 150 chansons générées à l’aide de prompts et de réglages répétés. Il a préféré v6 pour ses résultats plus riches et plus complets, a trouvé des directions inattendues intéressantes dans Wild et considère Mini comme une option viable pour les brouillons. Il indique également avoir bénéficié d’un accès anticipé et d’un partenariat avec Suno, ainsi que de liens affiliés. Ce contexte doit accompagner les éloges. La comparaison de Moe entre v6, Wild et Mini.
Un testeur sur Reddit a salué la fidélité, mais a rencontré des difficultés avec certains genres. L’auteur de « V6 and Wild: Initial thoughts » rapporte environ 50 générations. Il apprécie le son, tout en constatant une moins bonne adhérence pour des styles comme la UK garage et la liquid drum and bass. Il s’agit de l’expérience d’un utilisateur, et non d’une preuve qu’un genre entier ne peut pas fonctionner. V6 and Wild: premières impressions.
D’autres utilisateurs décrivent une régression. Dans un autre fil, l’auteur du post initial se plaint d’un son plus terne, d’une identité vocale incohérente et de prompts familiers produisant des résultats plus génériques. Les réponses expriment à la fois accord et désaccord. Suno v6 semble être une énorme régression.
Je peux penser que Suno sonne très bien tout en prenant ces critiques au sérieux. Un mixage soigné, un genre fidèle, une voix distinctive et une surprise utile sont des choses différentes. Aucune de ces discussions ne constitue une enquête représentative, et je ne les transformerais pas en pourcentage d’utilisateurs satisfaits.
Quatre alternatives open source et open-weight à surveiller
Les modèles locaux m’intéressent parce que les développeurs peuvent construire autour d’eux, conserver des checkpoints spécifiques et choisir leur propre workflow. La configuration, le matériel et les licences peuvent rendre cette liberté coûteuse en temps.
L’expression « open source » demande également de la prudence ici. Trois projets ci-dessous publient des licences permissives ; YuE2 sépare son code open source de conditions plus restrictives concernant les poids du modèle. Il s’agit d’une sélection pratique, et non d’un classement mesuré de popularité.
1. ACE-Step 1.5 et ses modèles XL
ACE-Step 1.5 est mon premier candidat à étudier pour un workflow de production local. Ses capacités documentées comprennent la génération conditionnée par les paroles, l’audio de référence, les covers, le repainting sélectif et la personnalisation avec LoRA. Le projet publie une licence MIT.
Sa sortie XL d’avril 2026 ajoute un décodeur de diffusion 4B plus grand. Les mainteneurs indiquent au moins 12 Go de VRAM avec offloading et recommandent au moins 20 Go. Les configurations plus petites ont des exigences différentes ; « fonctionne en local » ne signifie pas que chaque checkpoint tient sur chaque ordinateur portable.
Les options d’édition et d’intégration m’attirent. Je testerais la configuration matérielle réelle avant de faire confiance à une quelconque affirmation de vitesse mise en avant. Les comparaisons avec des modèles commerciaux du projet sont ses propres affirmations, et non un verdict indépendant sur v6.
2. HeartMuLa
HeartMuLa combine la génération de chansons avec des outils musicaux associés, notamment un codec et la transcription de paroles. Les mainteneurs recommandent leur version 3B de février 2026 pour la génération et indiquent que le dépôt ainsi que les poids associés utilisent Apache 2.0.
Je le placerais sur une liste restreinte pour des expérimentations guidées par les paroles et du contenu multilingue. Son écosystème d’outils m’intéresse autant qu’une seule chanson de démonstration. C’est une raison de l’étudier, et non ma propre évaluation de la qualité de ses voix.
3. DiffRhythm 2
DiffRhythm 2 vise les chansons complètes avec des paroles alignées grâce à une architecture de diffusion semi-autoregressive. Le dépôt place explicitement le code et les poids sous licence Apache 2.0.
Il fournit des scripts d’inférence et des exemples avec audio de référence, mais plusieurs fonctionnalités pratiques figurent encore sur sa liste TODO. Je le considère comme un candidat intéressant pour la recherche et l’intégration, plutôt que comme un remplacement prêt à l’emploi de l’expérience navigateur de Suno. La distinction compte si vous voulez faire de la musique ce soir plutôt que maintenir un environnement Python.
4. YuE2 : une nouvelle sortie avec une distinction de licence
YuE2 est arrivé en septembre 2026 avec un plan éditable de mélodie et d’accords avant la génération audio. Cette approche offre aux développeurs un autre point d’intervention dans la composition.
Son code utilise Apache 2.0. Les poids du modèle utilisent CC BY-NC 4.0 avec des autorisations supplémentaires pour les créateurs. Le projet permet aux créateurs personnels et aux musiciens de monétiser les sorties selon ces conditions, tandis que les entreprises doivent discuter d’une licence de modèle commerciale. Lisez la licence réelle du modèle, et pas seulement le badge de licence du dépôt.
Je trouve la composition éditable particulièrement intéressante. Je ne présente pas YuE2 comme un backend commercial sans restriction et je n’affirme pas que son audio régénéré préserve une performance identique.
Que montrent les benchmarks publiés ?
La comparaison WildSongBench de l’équipe YuE2 évalue 192 prompts. Voici une sélection de résultats issus de ses données publiées, en utilisant YuE2 standard plutôt que son réglage séparé best-of-eight.

| Système évalué | Moyenne SongBench, plus élevée = meilleure | Taux d’erreur phonémique, plus faible = meilleur |
|---|---|---|
| Suno v5.5 | 6.7150 | 5.96% |
| Suno v6 | 6.5562 | 7.58% |
| Suno v6 Wild | 6.4195 | 7.45% |
| YuE2 | 6.7316 | 8.44% |
| HeartMuLa | 6.2483 | 10.71% |
| ACE-Step 1.5 | 6.0118 | 7.46% |
| DiffRhythm 2 | 5.2428 | 18.41% |
SongBench est un évaluateur automatique de la qualité. Le taux d’erreur phonémique mesure les erreurs de transcription des paroles ; ce n’est pas une note indiquant si vous aimez la chanson. Les différentes métriques favorisent différents systèmes.
Il s’agit de comparaisons de systèmes publiées par les développeurs, avec une sélection de candidats et des protocoles de génération différents, et non de tests à ressources de calcul égales ou d’un sondage indépendant auprès d’auditeurs. Considérez-les comme un instantané du 12 septembre, et non comme une note concernant les mises à jour ultérieures. Les données n’établissent pas de supériorité statistiquement significative. Elles montrent également pourquoi l’idée que « le plus récent gagne toujours » est trop générale : v5.5 obtient un meilleur score que v6 sur ces deux métriques, malgré mon impression positive de Suno aujourd’hui. Résultats du benchmark YuE et portée de l’évaluation, résultats en précision complète.
La question des droits fait toujours partie de l’histoire
La plainte pour violation du copyright déposée contre Suno en 2024 alléguait la copie non autorisée d’enregistrements pour l’entraînement. Il s’agit d’une allégation formulée dans un document judiciaire, et non d’une conclusion que je peux établir en écoutant une chanson générée. La plainte déposée.
Les partenariats de v6 avec l’industrie représentent un changement dans l’approche déclarée de Suno, mais ils ne règlent pas tous les différends. MusicRadar a rapporté de nouvelles allégations d’Universal et de Sony concernant v6 le 22 septembre 2026. Les allégations d’Universal et de Sony concernant Suno v6.
Les conditions actuelles de Suno distinguent également l’utilisation personnelle et non commerciale du forfait gratuit de l’utilisation commerciale conditionnelle du forfait payant, notamment avec des exigences concernant les téléchargements autorisés. Elles ne garantissent pas qu’un copyright existe sur une sortie. Les droits liés aux éléments importés, les règles de remix et les politiques de votre plateforme de distribution restent importants. Conditions d’utilisation de Suno.
Mon avis : un meilleur son rend le contrôle plus précieux
Je suis positif quant au son de Suno aujourd’hui. Je veux utiliser ces progrès pour développer des idées, comparer des arrangements et essayer des directions que je laisserais autrement inachevées. Je n’ai pas besoin de prétendre que chaque résultat est un disque terminé pour trouver cela utile.
Ma prochaine comparaison conserverait les paroles et le brief, écouterait les résultats à volume égal et séparerait les premières impressions de la facilité d’édition. Je compterais également les tentatives échouées et le temps de configuration. Un outil qui produit parfois une chanson brillante peut tout de même être difficile à utiliser dans un délai serré.
Suno m’offre un endroit pratique pour explorer. ACE-Step et les autres projets locaux me donnent des raisons de regarder au-delà d’un seul service hébergé. Mon article précédent sur l’AI et la production musicale traite de cette relation plus large ; les sorties récentes rendent son étude plus concrète.
J’aime ce que j’entends. Maintenant, je veux des outils qui me permettent de faire davantage avec les parties qui méritent d’être conservées.
