Stable Audio sert au producteur qui cherche une boucle, une texture, un bruitage ou une base instrumentale à retravailler. Il convient moins à qui veut des paroles chantées en français, un export MIDI ou une chaîne de droits détaillée par forfait.
Test documentaire relu le 17 septembre 2026 : les prix et la licence ont été relus ce jour-là.
Cette page rejoint la rubrique IA et création musicale du magazine.
Que retenir de Stable Audio en bref ?
Stable Audio 3.0 vise surtout la production instrumentale et le travail par pistes. La version web ajoute une interface multipiste en bêta, tandis que les modèles téléchargeables donnent une autre porte d’entrée. Le tableau sépare les montants connus, les droits généraux et les zones où l’éditeur ne précise pas assez les conditions.
| Point | Ce que les sources consultées permettent d’établir |
|---|---|
| Usage principal | Générer de la musique, des samples, des boucles, des bruitages et des ambiances à partir de texte. Stable Audio 3.0 documente aussi l’édition de segments, la continuation, le remplacement de passages et le travail multipiste. L’interface web multipiste et le plug-in pour station audionumérique étaient annoncés en bêta le 18 août 2026. |
| Formule gratuite | Inscription gratuite avec 50 crédits à l’inscription. Le centre d’aide ne présente pas ces crédits comme une allocation mensuelle renouvelable. Les limites exactes d’export, de téléchargement et de fonctions entre gratuit et payant ne sont pas précisées par l’éditeur dans la grille accessible. |
| Prix des plans | Centre d’aide consulté le 17 septembre 2026 : Creator, 12 $/mois et 660 crédits par cycle mensuel ; Pro, 30 $/mois et 1 800 crédits ; Studio, 90 $/mois et 6 000 crédits ; Max, 199 $/mois et 14 000 crédits. La source affiche « $ », sans code ISO ni traitement des taxes. Prix annuels : non précisé par l’éditeur. |
| Droits commerciaux par plan | La version des CGU du 31 juillet 2025 inclut Stable Audio et prévoit que l’utilisateur conserve ses droits sur ses entrées, tandis que Stability AI cède les droits qu’elle détiendrait sur les sorties, dans la mesure permise par la loi. Les droits propres au gratuit, à Creator, Pro, Studio et Max ne sont pas détaillés dans une matrice contractuelle actuelle accessible. |
| Formats d’export | Le guide officiel d’août 2026 documente un export Mixdown en WAV et un export Stems dans un fichier ZIP, avec option de normalisation. Export MIDI natif, profondeur de bits par forfait et débit MP3 : non précisé par l’éditeur. La répartition des exports entre les plans n’est pas explicitée. |
| Langues | La fiche du modèle Stable Audio 3 Medium indique English comme langue du modèle. La liste officielle des langues et une garantie de compréhension des prompts français ne sont pas précisées par l’éditeur. |
| Ce qui manque | Prix annuels, taxes, devise ISO, prix des recharges, barème par opération, quotas de téléchargements, priorité de file, générations simultanées, matrice exacte des fonctions par forfait, autorisation Content ID et mention obligatoire dans les crédits : non précisé par l’éditeur ou non établi dans les pages consultées. |
Les montants et crédits viennent du centre d’aide sur les abonnements et le système de crédits, consulté le 17 septembre 2026. Les extraits commerciaux affichent aussi Solo, Session, Producer et Studio, sans préciser la correspondance.
Stable Audio est-il gratuit ?
Oui, l’inscription gratuite existe, mais elle apporte un seul capital initial de 50 crédits. Les abonnements affichent 660 à 14 000 crédits par cycle, tandis que la consommation dépend de l’opération et du nombre de pistes.
Le mot gratuit peut prêter à confusion. Selon le centre d’aide de Stability AI, le compte sans abonnement reçoit 50 crédits lors de l’inscription. Rien dans cette page ne transforme ce solde en recharge mensuelle. Les crédits des offres payantes, eux, reviennent au début du cycle de facturation et ne sont pas reportés au cycle suivant.
La grille documentaire donne quatre plans. Creator coûte 12 $ par mois pour 660 crédits. Pro coûte 30 $ par mois pour 1 800 crédits. Studio monte à 90 $ par mois pour 6 000 crédits. Max atteint 199 $ par mois pour 14 000 crédits. La page source affiche le symbole « $ ». Elle ne précise ni le code monétaire, ni les taxes, ni un équivalent annuel vérifiable.
Un crédit ne correspond pas automatiquement à un morceau. La consommation dépend de l’opération et du nombre de pistes. Le barème complet n’est pas exposé. Les recharges sont annoncées sans expiration, mais leur prix n’est pas précisé.
Le guide officiel indique qu’une génération échouée ne doit pas débiter de crédits. Le montage, le mixage, le travail sur des pistes existantes et leur export restent possibles quand le solde est épuisé. Cela rend l’édition plus lisible que la génération en série, dont le coût par titre reste impossible à calculer.
Que peut réellement faire Stable Audio 3.0 ?
Stable Audio 3.0 couvre quatre modèles, de Small SFX à Large, avec génération de durée variable, édition de segments et continuation. Small est annoncé jusqu’à deux minutes, Medium jusqu’à six minutes vingt secondes, et Large au-delà de six minutes. Les trois premiers modèles sont téléchargeables, tandis que Large passe par l’API et les déploiements d’entreprise.
L’annonce officielle du 20 mai 2026 décrit Small SFX pour les effets, Small et Medium avec des poids téléchargeables, et Large pour l’API et l’entreprise. Ce partage compte pour le travail local, car toutes les fonctions du site web ne sont pas annoncées dans les mêmes modèles.
La durée annoncée mérite une lecture précise. La présentation de Stability AI parle souvent de six minutes, mais l’article scientifique de mai 2026 chiffre Medium à six minutes vingt secondes. Il annonce une génération en moins de deux secondes sur un GPU Nvidia H200. Ce résultat de laboratoire ne promet pas le même délai sur un ordinateur personnel ni dans l’interface grand public.
La partie la plus intéressante pour un producteur se trouve dans l’édition. Le guide officiel distingue Full Mix, qui produit un mix complet, et Multi Track, qui génère des pistes séparées. Multi Track est encore présenté comme expérimental. Le centre d’aide ajoute les modes Develop, Blend et Contrast, le remplacement d’une région et l’extension par segments de 4, 8, 16 ou 32 secondes.
On peut aussi régler le seed et le nombre d’étapes, puis demander à un assistant textuel de modifier la session. C’est une logique plus proche d’une maquette que d’un simple bouton de génération. Le nombre maximal de pistes reste toutefois divergent : le guide du 18 août 2026 en décrit quatre, le centre d’aide jusqu’à onze.
L’annonce du 18 août 2026 parle d’une interface web multipiste et d’un plug-in pour station audionumérique, tous deux en bêta. Le guide documente macOS, VST3 et Audio Units, avec Ableton Live, Cubase, Reaper et Logic. Windows, AAX et certaines fonctions d’édition sont annoncés comme prévus. Pour un poste de home studio, l’intégration reste conditionnelle.
Comment fonctionne Stable Audio pour un producteur ?
Le parcours documenté commence par une demande textuelle, puis choisit un modèle et un mode de travail. Vous pouvez produire un mix complet, séparer les pistes, remplacer un passage ou prolonger une section. La session se termine par un mixdown WAV ou une archive de stems.
Décrivez d’abord l’instrumental recherché. La fiche Stable Audio 3 Medium indique English comme langue du modèle. Une langue officiellement prise en charge ne garantit donc pas une interprétation précise d’un prompt français, point à garder en tête avant d’évaluer le résultat.
Choisissez le type de session. Full Mix vise un morceau rendu en mix complet. Multi Track produit des pistes séparées et reste expérimental selon le guide officiel de création de mix.
Travaillez par régions. Le centre d’aide décrit Develop, Blend et Contrast, ainsi que le remplacement d’une zone et les extensions de 4, 8, 16 ou 32 secondes. Les réglages de seed et d’étapes servent à reprendre une direction sans repartir entièrement de zéro.
Exportez la session. Le guide d’août 2026 documente Mixdown en WAV et Stems dans un ZIP, avec normalisation en option.
Le travail sur piste existante et son export restent possibles lorsque les crédits sont épuisés, selon le guide officiel. Pour un producteur bedroom, le compte gratuit peut donc suffire à une première idée, puis bloquer les variantes. Le quota de téléchargements n’est pas publié de façon assez précise.
Que valent les voix en français ?
Stable Audio 3.0 est documenté pour les instrumentaux. Le guide admet des textures vocales non verbales, mais la génération de voix intelligibles n’est pas son objectif. Pour un prompt français, l’éditeur ne fournit ni liste de langues complète ni garantie de compréhension. Je le classerais donc du côté des atmosphères et chœurs abstraits, pas des chansons à paroles.
Le modèle Stable Audio 3 Medium affiche « English » comme langue sur sa fiche Hugging Face. Cette indication est utile, mais elle ne répond pas à la question pratique d’un chanteur francophone. Il ne permet donc pas d’affirmer qu’un prompt écrit en français conserve son intention, son accent ou sa structure musicale.
La documentation de Stability AI situe clairement le produit sur l’instrumental. Une texture de voix sans mots peut entrer dans une nappe, un bruit de bouche ou un arrière-plan. Une interprétation lisible avec des paroles personnalisées appartient à une autre catégorie de besoin.
Eleven Music documente un autre choix. ElevenLabs a annoncé le 5 août 2025 la musique instrumentale ou chantée avec contrôle des paroles. La page Music v2, annoncée le 26 mai 2026 et actualisée le 27 août, met en avant les voix multilingues, l’édition de sections et les références.
Quelle qualité audio peut-on attendre ?
La fiche technique est solide sur le format annoncé : Stable Audio 3.0 produit de la stéréo en 44,1 kHz, et Medium monte jusqu’à six minutes vingt secondes selon l’article scientifique. La qualité musicale reste plus difficile à trancher. Il faut donc séparer spécification et écoute.
La continuité historique explique certaines impressions contradictoires. En septembre 2023, Matt Mullen dans MusicRadar testait la première version et relevait un intérêt pour les boucles et le respect du tempo dans l’exemple observé, avec une erreur de tonalité sur une demande de piano. Ce compte rendu ne porte pas sur 3.0. Il ne peut pas servir de note actuelle, seulement de repère sur le premier produit public.
Les retours restent datés. IdealoGeek, dans son tutoriel de décembre 2023, jugeait l’outil très favorablement sans protocole détaillé. Des commentaires français évoquaient un manque de personnalité ou de finesse. Clubic, mis à jour le 16 septembre 2026, apprécie l’interface, la diversité et l’import audio, mais conserve des limites de trois minutes liées aux anciennes versions.
Dans r/comfyui, un fil consacré à Stable Audio 3 Base décrit un résultat éloigné du style lo-fi demandé. Sur Hacker News, certains critiquent le timbre ou la bande passante, d’autres apprécient la rapidité et les poids téléchargeables. Ces retours ne forment pas une mesure technique commune.
Notre position reste resserrée. Les documents donnent un intérêt réel à l’édition, aux pistes séparées et aux modèles locaux, sans promettre un rendu final homogène, une justesse constante ou un mix prêt à publier. Une idée, une couche sonore et un morceau terminé n’imposent pas le même niveau de contrôle.
À qui appartiennent les morceaux ?
Les CGU de Stability AI datées du 31 juillet 2025 incluent Stable Audio. Elles disent que l’utilisateur conserve ses droits sur ses entrées et que Stability AI lui cède les droits qu’elle détiendrait sur les sorties, dans la mesure permise par la loi. Cette clause générale ne donne pas une exclusivité et ne remplace pas une vérification du droit applicable.
La question des offres reste moins nette. Le guide publié en août 2026 affirme que l’utilisateur possède ses sorties et peut les commercialiser. Cette présentation ne forme pas une matrice contractuelle par abonnement.
Il faut aussi séparer le site web des modèles téléchargeables. La Stability AI Community License, mise à jour le 5 juillet 2024, autorise certains usages commerciaux sans redevance pour les personnes ou organisations sous le seuil de 1 million de dollars de chiffre d’affaires annuel, avec enregistrement pour l’usage commercial. Au-delà du seuil prévu par le contrat, une licence d’entreprise est requise. Ce régime concerne les modèles couverts, pas automatiquement l’abonnement web.
La même licence prévoit, dans certaines redistributions, une transmission de licence et de notice, ainsi que la mention « Powered by Stability AI » dans les situations définies. Elle exclut les sorties de sa définition des œuvres dérivées du modèle. Cela ne crée pas une obligation générale de crédit sur chaque fichier musical.
Peut-on vendre ou diffuser ce qu’on génère ?
Le guide commercial répond oui, mais sans sécurité contractuelle détaillée par forfait. Stability AI écrit que l’utilisateur possède ses sorties et peut les commercialiser. Les conditions propres au gratuit et aux plans web ne garantissent pas clairement une vente, une diffusion en streaming ou une inscription à Content ID.
Pour une vidéo de commande ou un habillage destiné à être vendu, le guide officiel apporte donc un signal favorable. Il ne précise pas la différence entre les 50 crédits initiaux et les crédits Creator, Pro, Studio ou Max. Il ne donne pas non plus de permission explicite pour YouTube Content ID. La mention obligatoire de Stable Audio dans les crédits d’un morceau web n’est pas précisée par l’éditeur.
Le point devient sensible dès que le fichier sort de votre session. Les CGU indiquent que des utilisateurs différents peuvent recevoir des résultats similaires. La politique d’utilisation interdit les atteintes aux droits de tiers et l’usurpation non consentie. Le centre d’aide précise que des prompts nommant des artistes identifiables peuvent être bloqués, notamment pour demander une imitation stylistique.
La provenance des entrées mérite attention. L’annonce de septembre 2023 citait AudioSparx comme partenaire. La fiche Hugging Face déclare 1 278 902 fichiers d’entraînement, dont 806 284 provenant d’AudioSparx et 472 618 de Freesound, avec des contenus CC0, CC BY et CC Sampling+. Ce sont des déclarations de l’éditeur, pas un audit indépendant.
La politique de confidentialité du 31 juillet 2025 couvre prompts et sorties, utilisés pour améliorer les services avec possibilité de refuser l’entraînement. Le centre de confidentialité précise que les fichiers audio téléversés ne servent pas à l’entraînement, tandis que les audios générés peuvent y contribuer. Un réglage permet de refuser cette utilisation.
Que disent les procès des majors ?
Les actions de la RIAA du 24 juin 2024 concernaient Suno et Uncharted Labs, le développeur d’Udio. Ces affaires éclairent le débat sur les données musicales, mais elles ne permettent pas d’attribuer le même statut juridique à Stable Audio.
La RIAA situait l’action contre Suno au Massachusetts et celle contre Uncharted Labs, développeur d’Udio, à New York. Sony Music Entertainment, UMG Recordings et Warner Records figuraient parmi les demandeurs. Warner a annoncé un règlement avec Suno le 25 novembre 2025, selon Reuters. UMG a conclu un accord avec Udio en octobre 2025, selon AP News. Reuters indiquait encore le 15 septembre 2026 qu’UMG poursuivait séparément Suno. La GEMA a annoncé le 31 juillet 2026 une victoire contre Suno à Munich, sans viser Stable Audio.
Stability AI mentionne des alliances avec Universal Music Group le 30 octobre 2025 et Warner Music Group le 19 novembre 2025 pour des outils professionnels et des modèles utilisant des données licenciées. Les communiqués ne publient ni la liste exhaustive des œuvres autorisées, ni le barème de rémunération, ni une licence générale. Le financement annoncé le 25 août 2026 avec Sony, UMG et WMG est un investissement, pas la publication d’une telle licence. En France, la SACEM a annoncé le 12 octobre 2023 son opposition à la fouille de données sur son répertoire. La position reproduite par le SNAC ne valide ni ne condamne spécifiquement Stable Audio.
Pour l’utilisateur, la leçon est moins spectaculaire mais plus utile. Les déclarations de partenaires et de sources de données éclairent la méthode annoncée. Elles ne garantissent ni l’exclusivité d’un morceau ni sa protection automatique par le droit d’auteur.
Comment Stable Audio se compare-t-il à AIVA et Eleven Music ?
Stable Audio se distingue par l’édition multipiste documentée, les stems WAV et les poids téléchargeables de certains modèles. AIVA met en avant l’édition MIDI et plus de 250 styles. Eleven Music documente le chant, les paroles et les voix multilingues.
| Outil | Usage documenté | Gratuit | Prix d’entrée | Droits |
|---|---|---|---|---|
| Stable Audio | Instrumentaux, samples, boucles, bruitages, édition et multipiste. | 50 crédits à l’inscription. | Creator, 12 $/mois, centre d’aide consulté le 17 septembre 2026. | Guide favorable à la commercialisation. Détail par plan web : non précisé par l’éditeur. |
| AIVA | Plus de 250 styles, influences audio ou MIDI, édition et téléchargement MIDI. | Gratuit non commercial, site officiel consulté le 17 septembre 2026. | Pro : non précisé par l’éditeur dans les sources consultées. | Le forfait Pro attribue les droits annoncés à l’utilisateur. |
| Eleven Music | Musique instrumentale ou chantée, paroles, remix, sections et références. | Non précisé par l’éditeur dans les sources consultées. | Non précisé par l’éditeur dans les sources consultées. | Non précisé par l’éditeur dans les sources consultées. |
| Suno | Génération musicale, cité dans les procédures et accords IA. | Non précisé par l’éditeur dans les sources consultées. | Non précisé par l’éditeur dans les sources consultées. | Droits propres non établis dans les sources consultées. |
| Udio | Génération musicale, service développé par Uncharted Labs. | Non précisé par l’éditeur dans les sources consultées. | Non précisé par l’éditeur dans les sources consultées. | Droits propres non établis dans les sources consultées. |
Le choix dépend d’abord de la matière à sortir. AIVA a l’avantage documentaire du MIDI, absent des exports Stable Audio examinés ici. Eleven Music est plus directement positionné sur le chant intelligible et les paroles. Stable Audio garde un intérêt pour la transformation, la continuation et le travail sur des pistes. Suno et Udio ne peuvent pas être comparés honnêtement sur le prix ou la licence avec les seuls éléments de ce dossier.
Pour quel usage je le recommande, et pour lequel non ?
Je recommande Stable Audio pour une matière instrumentale, un fond vidéo, la transformation d’un sample ou une session multipiste. Je le déconseille pour une chanson francophone à paroles, une composition qui exige du MIDI ou un projet avec licence commerciale détaillée par abonnement. La décision repose sur les fonctions documentées, pas sur une écoute de la rédaction.
Le meilleur cas d’usage est une séance où la production humaine reste devant. Vous générez une base, puis vous coupez, arrangez, mixez et remplacez les passages utiles. Le guide documente ces gestes. La continuation par blocs de 4 à 32 secondes peut prolonger une nappe ou une transition.
Un créateur vidéo peut y trouver des textures et des instrumentaux. Avant livraison, vérifiez le format disponible et la clause de commercialisation. C’est le même réflexe que dans un logiciel de home studio.
Je passerais mon tour pour un projet de chanteur. Stable Audio 3 est décrit pour l’instrumental, sans paroles personnalisées ni voix intelligibles comme objectif. Eleven Music correspond davantage au besoin de chant et de paroles.
Enfin, je ne le choisirais pas seul pour sécuriser un catalogue destiné à une diffusion massive. Les conditions du web, Content ID, le crédit obligatoire et la garantie d’exclusivité restent trop peu détaillés. Cette réserve porte sur le contrat, qui compte autant que le fichier audio dans cet usage.
Nous avons relu les annonces de Stability AI sur Stable Audio, 2.0, 2.5 et 3.0, ainsi que celle du 18 août 2026 sur l’interface web et le plug-in. Une fonction annoncée en bêta ou comme future n’est pas traitée comme stable.
Nous avons utilisé le centre d’aide sur les plans et crédits, car la page Pricing n’expose pas intégralement son tableau dans le contenu récupérable. Nous avons gardé ses noms Creator, Pro, Studio et Max, en signalant la divergence avec les extraits commerciaux.
Nous avons relu les CGU du 31 juillet 2025, la politique d’utilisation, la politique de confidentialité, le centre de confidentialité et la Community License. La page annonçant une prise d’effet au 30 septembre 2026 n’est pas traitée comme applicable.
Nous avons séparé les déclarations de Stability AI sur l’entraînement des éléments indépendants. Les chiffres de la fiche Stable Audio 3 Medium sont attribués à l’éditeur. Les remarques de MusicRadar, IdealoGeek, Reddit et Hacker News restent des retours situés, pas une mesure représentative.
Cette méthode interdit une conclusion sonore trop précise. Les retours concernent des versions et des contextes différents.
Questions fréquentes sur Stable Audio
Peut-on utiliser un morceau dans une vidéo monétisée ?
Le guide officiel de Stable Audio affirme que l’utilisateur possède ses sorties et peut les commercialiser. Les conditions propres à chaque plan web ne détaillent pas la vente, la diffusion en streaming ou l’admission à YouTube Content ID. Pour une vidéo monétisée, vérifiez la clause en vigueur dans votre compte et gardez la trace du plan utilisé.
Stable Audio comprend-il les prompts en français ?
La fiche de Stable Audio 3 Medium indique English comme langue du modèle. L’éditeur ne publie pas de liste complète ni de garantie pour les prompts français. La documentation insiste surtout sur les instrumentaux et les textures vocales non verbales. Une réponse musicale correcte en français ne peut donc pas être promise par cette review.
Peut-on exporter du MIDI ?
Le guide officiel documente un Mixdown en WAV et un export Stems sous forme de ZIP, avec normalisation en option. AIVA, de son côté, annonce l’édition et le téléchargement MIDI sur son site officiel. Pour reprendre une composition dans un séquenceur, cette différence peut peser davantage que le prix d’entrée.
Les fichiers audio importés servent-ils à entraîner le modèle ?
Le centre de confidentialité de Stability AI précise que les fichiers audio téléversés dans Stable Audio ne servent pas à l’entraînement. Il indique que les audios générés peuvent contribuer à l’amélioration des services et qu’un réglage permet de refuser cette utilisation. La politique du 31 juillet 2025 couvre aussi les prompts et les sorties.
