grolektif

YuE : avis, prix, droits et limites en 2026

YuE : avis complet sur le prix, les droits, le français, les exports et les limites de YuE2, avec une comparaison détaillée à ACE-Step, MusicGen et Suno.

YuE intéressera le producteur qui veut générer localement une chanson à partir de paroles, d’un style et, avec YuE v1, d’une référence audio. Il convient moins à qui cherche une application prête à l’emploi, un tarif lisible ou une garantie sur le français, le Content ID et les droits exclusifs. Cette review porte sur la documentation et les retours publiés.

YuE en bref

Point vérifiéCe que disent les sources
Usage principalGénération de chansons à partir de paroles et d’un style avec YuE2, planification de mélodie et d’accords, génération instrumentale et conditionnement audio décrits pour YuE v1.
Formule gratuite et limitesYuE2 annonce un usage gratuit pour un créateur individuel qui crée et monétise des morceaux. La recherche et l’enseignement non commerciaux sont annoncés comme gratuits. Crédits, quotas et coût d’une génération ratée : non précisé par l’éditeur.
Prix des plansAucun plan Free, Pro ou Premier identifié. La page Tarifs officielle n’est pas documentée. Aucun montant mensuel, annuel ou devise publique. Pour l’exploitation commerciale des poids par une entreprise, l’éditeur demande un contact, sans tarif public au 17 septembre 2026.
Droits commerciaux par planLes plans n’ont pas été identifiés. YuE v1 est annoncé sous Apache 2.0. La permission complémentaire de YuE2 autorise le créateur individuel à publier, vendre, licencier et monétiser ses productions, sans redevance aux concédants. L’exploitation commerciale des poids par une entreprise demande une licence à discuter.
Formats d’exportYuE v1 écrit des fichiers MP3 et reconstruit séparément voix et accompagnement. YuE2 prévoit un FLAC stéréo à 48 kHz, une partition ABC et des fichiers de planification ou de génération. Export WAV et stems instrument par instrument : non précisé par l’éditeur.
LanguesYuE v1 mentionne l’anglais, le mandarin, le cantonais, le japonais et le coréen. YuE2 porte les étiquettes chinois et anglais. Prise en charge officielle du français avec niveau de qualité ou taux d’erreur : non précisé par l’éditeur.
Ce qui manqueStudio commercial officiel, application mobile, extension de navigateur, API hébergée facturée à la requête, politique de confidentialité des prompts, clause Content ID, garantie de copyright exclusif, filigrane audio spécifique et tarif d’entreprise : non précisé par l’éditeur.

YuE est-il gratuit ?

Oui pour certains usages, mais il faut distinguer le logiciel, les poids et le statut de l’utilisateur. YuE v1 est distribué sous Apache 2.0. YuE2 annonce un usage gratuit pour le créateur individuel et la recherche non commerciale. Il n’existe pas, dans les sources relues, de grille d’abonnement avec crédits, quota ou prix par génération.

Le mot gratuit peut induire en erreur ici. YuE n’est pas présenté comme un service en ligne où l’on ouvre un compte pour recevoir quelques essais par mois. Le dépôt fournit du code et des modèles à faire tourner localement. La fiche Hugging Face et la documentation GitHub ne publient pas de plan Free, Pro ou Premier, ni de compteur de crédits.

Pour un créateur individuel, le document de licence de YuE2 annonce une permission supplémentaire. Elle couvre la publication, la vente, la licence et la monétisation des productions, sans redevance aux concédants. Elle ne transforme pas pour autant les poids en service hébergé. Il faut disposer de la machine et installer l’environnement.

Le cas d’une entreprise est différent. L’exploitation commerciale des poids YuE2 demande de contacter l’éditeur pour discuter d’une licence commerciale. Le montant et la devise ne sont pas précisés par l’éditeur.

YuE est-il un service en ligne ou un logiciel local ?

YuE est documenté comme une distribution locale de modèles et de code. YuE2 expose une API Python avec les étapes plan, generate_semantic, synthesize et decode, mais pas une API commerciale hébergée facturée à la requête. Une interface communautaire Gradio existe autour de YuE v1. Elle ne prouve pas l’existence d’un produit officiel nommé YuE Studio.

Vous ne payez pas un abonnement YuE officiel tel qu’il est décrit dans les sources. Vous devez plutôt réunir l’environnement logiciel, télécharger les modèles et fournir le calcul. La documentation actuelle prescrit Python 3.12, tandis que la fiche Hugging Face mentionne Python 3.10 ou supérieur et le paquet 0.1.5.

La release GitHub consultée est numérotée 0.1.6. Elle annonce des changements d’empaquetage, de licence et d’accès en ligne de commande, tout en indiquant une génération de contrôle identique à celle de 0.1.5. Cette coexistence de versions mérite une vérification avant installation. Un tutoriel ancien peut décrire une commande qui ne correspond plus à la release utilisée.

Le projet propose aussi le paquet yue2-music, capable de piloter une génération, une transcription, une vérification de partition et une comparaison de résultats avec un agent compatible avec le format SKILL.md. C’est une intégration documentée dans GitHub, pas une offre d’abonnement. Pour un musicien qui ne veut pas gérer Python, CUDA et les dépendances, le coût réel est donc surtout un coût d’installation.

Que valent les voix en français ?

Il n’est pas possible de donner un verdict sérieux sur le français à partir des sources autorisées. YuE v1 cite l’anglais, le mandarin, le cantonais, le japonais et le coréen. YuE2 porte les étiquettes chinois et anglais. L’éditeur ne précise ni qualité vocale en français, ni taux d’erreur, ni protocole d’évaluation francophone.

Le retour de GIGAZINE sur les exemples multilingues donne un repère, mais pas une réponse française. Le média juge le chant japonais intelligible, tout en trouvant la prononciation moins naturelle que celle d’un locuteur natif.

Les paroles de YuE2 reçoivent des balises de sections, comme couplet et refrain. Le champ style peut préciser le genre, les instruments, le caractère vocal, la langue et le tempo. Sur le papier, les paramètres nécessaires à une chanson française sont donc présents. Cela ne renseigne pas la diction obtenue, la place des syllabes, les élisions ou la stabilité d’un refrain.

Si le texte français est central pour votre morceau, gardez une étape de vérification humaine et prévoyez une reprise vocale. Le projet ne fournit pas, dans les documents consultés, une démonstration notée en français comparable au commentaire de GIGAZINE sur le japonais.

Comment fonctionne YuE2 et que peut-on générer ?

YuE2 reçoit des paroles et des indications de style. Son mode full planifie mélodie et accords, le mode melody planifie la mélodie, et le mode off ne demande pas de plan symbolique. Le système peut aussi passer par une partition ABC, transcrire une prise pour fabriquer une cover et générer un instrumental avec YuE v1.

Le choix du mode n’est pas un simple réglage cosmétique. Le plan symbolique donne une prise sur la structure avant la synthèse audio. En mode full, les paroles restent liées à une organisation de mélodie et d’accords. En mode off, vous perdez cette étape de planification. La documentation ne promet pas qu’une variante produira une prise plus naturelle dans tous les genres.

L’édition de YuE2 passe par une composition en notation ABC. Vous pouvez modifier les notes, les accords, le tempo, l’ordre des sections, les paroles et le style. Garder une partie de la partition ne garantit pas la même voix, le même timbre ou la même forme d’onde dans les passages qui semblent inchangés.

Le parcours de cover utilise SheetSage2 pour transcrire l’enregistrement, examiner sa mélodie, puis générer une nouvelle interprétation dans le style demandé. Il ne demande pas un entraînement spécifique du modèle pour chaque reprise. La documentation prévient que les erreurs de transcription peuvent se retrouver dans le résultat. Une prise mal analysée peut donc contaminer la génération dès l’étape de partition.

YuE v1 documente aussi le conditionnement audio à partir d’extraits de référence de 20 à 40 secondes, en une ou deux pistes. L’objectif annoncé est de reprendre des caractéristiques vocales et stylistiques, y compris entre langues. Le rapport scientifique signale un risque de reproduction de la mélodie dans certaines configurations de continuation. Cette fonction appelle donc une vérification des droits sur la référence.

Pour l’instrumental, le rapport scientifique décrit une génération obtenue en remplaçant les paroles par un saut de ligne. Ce n’est pas un palier payant. Une issue GitHub du 29 janvier 2025 signale toutefois des erreurs lors de certaines tentatives sans paroles. Ce retour individuel ne prouve pas une impossibilité générale, puisque la méthode instrumentale est ensuite décrite dans le rapport.

Quel ordinateur faut-il pour faire tourner YuE ?

YuE2 vise une machine équipée de 24 Go de mémoire vidéo et de 24 Go de mémoire système pour une chanson à la fois, selon sa fiche Hugging Face. Sur RTX 4090, les développeurs annoncent 71,04 secondes de calcul pour 214,85 secondes d’audio, avec un pic de 11,18 Gio de mémoire vidéo.

Les témoignages du fil Reddit consacré à YuE GP parlent de lenteur, de CUDA, de FlashAttention, de dépendances et d’instructions d’installation. Les configurations et versions varient, et ces retours concernent surtout l’écosystème YuE v1.

La vitesse publiée reste intéressante pour situer le projet. 71,04 secondes de calcul pour 214,85 secondes d’audio signifie que l’exemple de référence est plus long que le temps de calcul mesuré sur la carte indiquée. Cela ne décrit ni le temps de téléchargement, ni la préparation, ni une machine plus ancienne. Le projet ne fournit pas dans les sources relues un tableau de performances pour plusieurs GPU.

Pour un bedroom producer sans GPU dédié, l’installation locale n’a donc rien d’immédiat. On peut aimer le contrôle des fichiers locaux et accepter cette contrainte. On peut aussi préférer un outil hébergé, même si son prix est moins lisible. Cette dernière option sort du produit YuE tel que les sources le documentent.

Quels formats et quels stems peut-on exporter ?

YuE v1 et YuE2 n’annoncent pas exactement la même sortie. Le script v1 reconstruit séparément la voix et l’accompagnement, puis écrit des fichiers MP3. YuE2 prévoit un FLAC stéréo à 48 kHz, avec, selon le mode, une partition ABC et des fichiers de planification ou de génération.

La séparation voix et accompagnement de v1 peut servir à reprendre la voix ou l’instrumental dans un arrangement. Elle ne signifie pas que le logiciel exporte une batterie, une basse, une guitare et des claviers isolés. Le script consulté utilise un décodage intermédiaire à 16 kHz, puis une étape de suréchantillonnage à 44,1 kHz, avant l’écriture des fichiers MP3.

La sortie YuE2 est plus intéressante pour une logique d’édition. Le FLAC est accompagné des éléments symboliques qui permettent de modifier une note, un accord, un tempo ou une section, puis de relancer un enregistrement. C’est une approche différente d’un outil qui retouche directement une portion audio. Le mot édition recouvre donc ici un changement de composition, pas une réparation locale garantie.

Le guide de génération prévoit aussi un indicateur de troncature. Un fichier audio peut être lisible alors que la génération a été interrompue par une limite de tokens. Il faut donc contrôler ce signal avant de livrer un morceau. Le projet ne précise pas de débit fixe, de sortie WAV commerciale ou de mode Persona.

À qui appartiennent les morceaux ?

La licence distingue clairement les droits sur le code, les poids et les productions. YuE v1 annonce Apache 2.0 pour le modèle et ses poids, avec un encouragement à l’utilisation commerciale. YuE2 place ses poids et ses décodeurs VAE sous CC BY-NC 4.0, puis ajoute une permission pour le créateur individuel.

Pour le créateur individuel, le MODEL_LICENSE de YuE2 autorise la publication, la vente, la licence et la monétisation des productions, notamment auprès de clients et sur des plateformes commerciales, sans redevance aux concédants. Le crédit sur les morceaux est facultatif. L’attribution reste applicable à la redistribution des poids.

Le même texte vise des usages illégaux, nuisibles ou trompeurs, dont la fraude, le harcèlement et l’usurpation trompeuse. Il demande aussi d’obtenir les droits et consentements nécessaires. La permission ne confère pas de droits sur les éléments appartenant à des tiers. Cela compte pour les paroles fournies, une prise de référence et l’imitation d’une identité vocale.

Apache 2.0 impose de son côté des obligations lors de la redistribution du matériel couvert, notamment fournir la licence, conserver les notices applicables et identifier les modifications. Ces obligations concernent le logiciel ou le matériel distribué. Elles ne déclarent pas que chaque chanson générée bénéficie automatiquement d’un droit exclusif, quel que soit l’apport humain ou le droit applicable.

Le paramètre local_files_only=True est une option technique de chargement, pas une politique contractuelle de confidentialité.

Peut-on vendre ou diffuser ce qu’on génère ?

Un créateur individuel peut vendre, licencier et monétiser des productions YuE2 selon la permission complémentaire datée du 16 septembre 2026, sans redevance aux concédants. Cette autorisation ne vaut pas garantie d’admission chez un distributeur, dans YouTube Content ID ou sur chaque plateforme. L’entreprise qui exploite commercialement les poids doit discuter d’une licence séparée avec l’éditeur.

La nuance est pratique. Le droit de monétiser la production et l’acceptation par une plateforme sont deux questions différentes. Le document de licence de YuE2 ne contient pas de clause Content ID spécifique. Il ne garantit pas non plus que YouTube, un distributeur ou un service de streaming acceptera un titre généré avec le modèle.

Spotify et Deezer donnent un cadre de plateforme qui ne vise pas spécifiquement YuE. Dans son annonce du 11 août 2026, Spotify décrit un badge AI Persona pour certaines identités d’artistes artificielles, avec exclusion par défaut de recommandations dans les cas prévus. Le badge porte sur l’identité publique de l’artiste, pas sur la manière dont la musique a été fabriquée.

Le communiqué de Deezer, daté du 16 septembre 2026, indique que les chansons entièrement générées par IA sont exclues de ses recommandations algorithmiques et de ses playlists éditoriales, avec signalement des albums concernés. Deezer annonce aussi la démonétisation des écoutes identifiées comme frauduleuses et le retrait de certains titres. Ce n’est pas une démonétisation automatique de toute écoute de toute musique IA.

Le même communiqué indique que la SACEM, Buma-Stemra et EJI ont adopté la technologie de détection de Deezer. Cette information porte sur la détection. Elle ne constitue pas un accord autorisant l’entraînement de YuE sur ces répertoires.

Que disent les procès des majors ?

Elles ne précisent ni tribunal, ni numéro de procédure, ni date de dépôt, ni accord de licence entre YuE et une major. Elles ne donnent pas non plus de position de la SACEM ou de la GEMA visant nommément YuE.

La liste publique et contractuellement documentée des catalogues autorisés pour l’entraînement de YuE n’est pas précisée par l’éditeur dans les documents relus.

Pour un créateur, le point opérationnel est ailleurs : la licence demande d’obtenir les droits et consentements nécessaires et rappelle que YuE ne donne pas de droits sur les éléments de tiers. Une mélodie, une voix de référence ou des paroles protégées peuvent donc créer une difficulté indépendamment du prix nul du modèle. Les sources ne formulent pas une autorisation générale d’imiter n’importe quelle voix réelle.

Apache 2.0, CC BY-NC 4.0 et la permission complémentaire disent comment certains éléments peuvent être utilisés. Ils ne remplacent pas l’analyse des entrées, des contributions humaines, des droits de tiers et des règles de la plateforme où le titre sera publié.

Comment YuE se compare-t-il à ACE-Step, MusicGen, Stable Audio Open et Suno ?

YuE se distingue surtout par le contrôle symbolique, les paroles chantées et l’exécution locale, mais il demande une machine conséquente. ACE-Step couvre davantage de manipulations audio documentées. MusicGen n’est pas une solution équivalente pour chanter des paroles personnalisées.

Le comparatif publié par l’équipe YuE2 donne un point de mesure. Sur 192 prompts et 17 configurations, le score moyen SongBench annoncé est de 4,9165 pour YuE 1, 6,0118 pour ACE-Step 1.5, 6,7316 pour YuE2 et 6,9632 pour YuE2 avec une sélection parmi huit candidats. La configuration standard YuE2 sélectionne déjà entre deux candidats.

Les auteurs précisent que les expériences ne sont pas à budget de calcul égal, que les petits écarts ne prouvent pas une significativité statistique et que les scores ne mesurent pas une préférence humaine. Les évaluations YuE2 utilisent en outre le décodeur YuE2-Vae-legacy, différent du décodeur d’écoute par défaut.

AlternativeUsage documentéGratuitPrix d’entréeDroits
ACE-Step 1.5Génération de 10 secondes à 10 minutes, plus de cinquante langues, covers, modification de portions audio, séparation de pistes et adaptation LoRA. Détails dans notre test d’ACE-Step.Voir le test.Voir le test.Voir le test.
MusicGenGénération depuis une description textuelle ou un conditionnement audio, sortie à 32 kHz. La fiche précise que les voix réalistes ne sont pas produites.non précisé par l’éditeur dans les sources reluesnon précisé par l’éditeur dans les sources reluesCode MIT, poids CC BY-NC 4.0.
Suno 5Service en ligne de chansons complètes par prompt. Détails dans notre test de Suno.Voir le test.Voir le test.Voir le test.
Stable Audio OpenModèle ouvert de Stability AI pour sons et instrumentaux. Détails dans notre test de Stable Audio.Voir le test.Voir le test.Voir le test.

ACE-Step est l’alternative la mieux renseignée dans cette comparaison. Son dépôt annonce des durées de 10 secondes à 10 minutes, plus de cinquante langues, des covers, une modification de portions audio, la séparation de pistes et l’adaptation LoRA. Il documente aussi des configurations réduites en mémoire, mais elles ne sont pas directement équivalentes au parcours YuE2 recommandé sur GPU de 24 Go.

La différence d’édition est nette. ACE-Step annonce des opérations de retouche audio. YuE2 décrit la modification d’une composition symbolique suivie d’un nouvel enregistrement intégral. Si vous voulez préserver une portion audio existante, ces deux promesses ne recouvrent pas le même besoin. Pour le détail, notre avis sur ACE-Step donne un point de comparaison éditorial distinct.

MusicGen appartient à une autre famille d’usage. Sa fiche Hugging Face décrit des sorties à 32 kHz depuis un texte ou un audio, mais précise que les voix réalistes ne sont pas produites et que les descriptions dans une autre langue que l’anglais donnent généralement de moins bons résultats. Pour une ambiance ou une matière instrumentale, c’est une alternative documentée. Pour un refrain français chanté, non.

GIGAZINE présente YuE2 en regard de Suno 5, à partir de démonstrations et de mesures publiées. L’article ne fournit pas un protocole indépendant qui établirait une supériorité générale à l’écoute. Pour ce terrain, consultez notre test de Suno, puis vérifiez les conditions du service au moment de publier.

Pour quel usage je recommande YuE, et pour lequel non ?

YuE convient à un créateur individuel qui sait installer un modèle local, dispose d’une machine adaptée et veut garder la main sur la partition, les paroles et la génération. Il convient moins à une commande urgente, une production sans GPU, une voix française garantie ou un usage d’entreprise qui attend un tarif et une licence immédiatement lisibles.

Le bon profil est assez précis. Il accepte de travailler avec une documentation en mouvement, de distinguer YuE v1 de YuE2 et de contrôler les sorties. Il peut exploiter une partition ABC, relancer un enregistrement complet après une modification et conserver les fichiers locaux. Pour lui, le modèle donne un espace de recherche musicale plus contrôlable qu’une simple zone de prompt.

Le mauvais profil cherche un bouton, une facture et un support commercial. YuE n’est pas présenté comme un studio officiel, une application mobile ou une extension de navigateur. Le temps passé à résoudre l’environnement peut dépasser l’intérêt d’un essai ponctuel.

Pour une vidéo, le modèle peut servir à fabriquer une maquette, un morceau de travail ou une piste dont vous contrôlez la structure. Pour une sortie publique, je vérifierais les droits sur chaque élément fourni et les règles du distributeur. Le texte de licence autorise la monétisation du créateur individuel, mais ne promet ni copyright exclusif, ni Content ID, ni acceptation automatique par une plateforme.

Il existe aussi un compromis simple : utiliser YuE pour la composition et réserver la voix finale à un musicien ou à une prise dont les droits sont clairs. Cette méthode respecte mieux la limite documentaire sur le français et réduit le risque lié à une référence vocale. Elle demande une étape de production supplémentaire. YuE gagne alors sa place comme outil de maquette et d’arrangement, pas comme chaîne complète garantie.

Pour la réception, Tom’s Guide jugeait la qualité de YuE v1 étonnamment bonne tout en signalant le besoin d’un ordinateur puissant. L’ouverture directe de l’article ayant échoué lors des dernières vérifications, nous retenons le verdict de la notice éditoriale accessible, pas un récit détaillé de manipulation. GIGAZINE est cité pour ses commentaires et la présentation de YuE2.

Questions fréquentes

Les questions ci-dessous reprennent les points qu’un musicien vérifie avant d’installer YuE.

Peut-on générer seulement de la musique, sans paroles ?

Oui, le rapport scientifique de YuE v1 décrit une génération instrumentale en remplaçant les paroles par un saut de ligne. Une issue GitHub signale pourtant des erreurs dans certaines tentatives sans paroles. Ce signalement individuel ne prouve pas une impossibilité générale. La documentation de YuE2 présente aussi un mode off sans plan symbolique, mais ne le décrit pas comme un bouton instrumental universel.

YuE peut-il cloner une voix ?

YuE v1 documente un conditionnement par extraits de référence de 20 à 40 secondes, avec une ou deux pistes, afin de reprendre des caractéristiques vocales et stylistiques, y compris entre langues. Le consentement et les droits nécessaires restent à obtenir, et le risque de reprise de mélodie est signalé.

YuE comprend-il le français ?

L’éditeur ne précise pas une prise en charge officielle du français avec une mesure de qualité. YuE v1 cite l’anglais, le mandarin, le cantonais, le japonais et le coréen. YuE2 porte les étiquettes chinois et anglais. GIGAZINE décrit le japonais comme intelligible, mais moins naturel qu’un locuteur natif. Ce retour ne permet pas d’évaluer la diction française.

Peut-on utiliser YuE pour une chanson vendue à un client ?

Un créateur individuel peut publier, vendre, licencier et monétiser une production YuE2 selon la permission complémentaire du 16 septembre 2026, sans redevance aux concédants. Une entreprise qui exploite commercialement les poids doit discuter d’une licence avec l’éditeur, dont le tarif n’est pas précisé.

YuE donne-t-il des stems et un fichier WAV ?

YuE v1 reconstruit séparément la voix et l’accompagnement, puis écrit des MP3. YuE2 prévoit un FLAC stéréo à 48 kHz, avec une partition ABC et des fichiers de génération selon le mode.

Quelle alternative choisir si je veux retoucher un audio existant ?

ACE-Step 1.5 est l’alternative la plus directement documentée pour ce besoin : son dépôt annonce la modification de portions audio, la séparation de pistes, les covers et l’adaptation LoRA. YuE2 édite plutôt une composition symbolique puis recrée un enregistrement complet. Si vous devez préserver une forme d’onde, ces parcours ne promettent pas la même chose.

Pour les traitements de voix et de production autour d’un morceau, nos pages sur Moises et Stable Audio permettent de situer d’autres approches. Elles ne remplacent pas la lecture des licences propres à chaque outil. La comparaison avec YuE doit rester limitée aux fonctions documentées ici.

Sa licence YuE2 ouvre la monétisation au créateur individuel, son plan symbolique donne une prise intéressante sur la composition et ses alternatives sont mieux adaptées à certains gestes audio. En échange, il faut accepter l’installation, le matériel et les zones grises sur le français et les plateformes.