Stable Audio 3.0 icône
Stable Audio 3.0Icône vérifiée Veriblue
#8 dans Musique
4.4/5
« Générez jusqu'à 6 minutes 20 de musique ou de sons haute fidélité à partir d'un simple texte. Ces modèles open source permettent également l'édition, la prolongation et l'inpainting audio sur du matériel grand public »
En savoir plus : ChatGPT Perplexity
Icône vérifiée
Outil Vérifié
Gratuit 12988

Stable Audio 3.0 : six minutes de musique par piste et trois modèles en libre téléchargement

Stable Audio 3.0 est une famille de quatre modèles de génération audio de Stability AI, entraînés uniquement sur des données sous licence: vous décrivez un morceau ou un bruitage en texte, le modèle rend un fichier stéréo 44,1 kHz. Trois variantes sur quatre se téléchargent gratuitement sur Hugging Face, poids compris. Les pistes grimpent à plus de six minutes, là où Stable Audio 2.0 plafonnait à trois. Pas de version française du site pour l'instant: interface et documentation restent en anglais.

Avantages
  • Trois modèles en poids ouverts, téléchargement gratuit
  • Pistes de plus de six minutes, durée réglable à la seconde
  • Entraînement intégralement sur catalogue sous licence
  • Composition complète hors ligne, même sur téléphone
Inconvénients
  • Aucune voix chantée ni parole générée
  • Interface et documentation en anglais seulement
  • Le modèle Large réservé à l'API et aux entreprises

Quatre modèles, du bruitage de poche au morceau de six minutes

La gamme Stable Audio 3.0 aligne quatre variantes: Small SFX, Small, Medium et Large, toutes bâties sur un modèle de diffusion latente qui produit de l'audio stéréo en 44,1 kHz. La durée se règle à la seconde près: vous tapez « nappe ambiante chaude, 90 BPM, six minutes » et la piste sort à la longueur demandée.

L'inpainting audio fait partie du lot: vous gardez l'intro d'un morceau et régénérez la fin. Et Small compose un titre complet de deux minutes directement sur un téléphone, hors ligne, là où l'ancien Stable Audio Open Small plafonnait à onze secondes.

ModèleDurée maximaleAccès
3.0 Small SFXBruitages et effets courtsPoids ouverts (Hugging Face)
3.0 Small2 minutesPoids ouverts, tourne sur mobile
3.0 MediumPlus de 6 minutesPoids ouverts (Hugging Face)
3.0 LargePlus de 6 minutesAPI Stability AI, hébergement entreprise
Stable Audio 3 en local dans ComfyUI, musique et bruitages

Stable Audio 3.0 joue la carte des données sous licence

Tous les modèles Stable Audio 3.0 ont été entraînés sur des données intégralement sous licence, une position rare dans la musique générée par IA. Sous la licence Community, vos sorties vous appartiennent, vente et diffusion comprises; au-delà d'un million de dollars de revenu annuel, la licence Enterprise prend le relais avec indemnisation juridique.

Là où le dossier devient intéressant: les générateurs de musique par IA se divisent en deux écoles, la chanson chantée clé en main façon Suno ou Udio, et le moteur instrumental ouvert que vous contrôlez de bout en bout. Stable Audio 3.0 assume la seconde voie, poids du modèle inclus.

Essayer Stable Audio 3.0 sans carte bancaire

L'essai le plus rapide passe par stableaudio.com, dont la formule gratuite inclut 6 générations par mois avec le nouveau modèle. Un espace de démonstration Hugging Face fonctionne aussi sans compte, dans la limite des quotas de la plateforme. Les bidouilleurs préféreront ComfyUI et ses workflows prêts à l'emploi (prévoyez le téléchargement, les poids pèsent plusieurs gigaoctets).

En local, Small tourne même sans carte graphique via CoreML, et Medium se contente d'environ 5 Go de mémoire vidéo en décodage par blocs. Large, lui, passe par l'API payante de Stability AI. Quotas et conditions évoluent au fil des versions, un détour par la page officielle évite les mauvaises surprises.

Questions fréquentes

Stable Audio 3.0 est-il gratuit ?

Oui, en grande partie: Small SFX, Small et Medium se téléchargent gratuitement sur Hugging Face et tournent en local sans abonnement. Le site stableaudio.com ajoute 6 générations gratuites par mois. Seul Large, le plus puissant de la famille, exige de passer par l'API payante de Stability AI ou un contrat entreprise.

Peut-on vendre la musique créée avec Stable Audio 3.0 ?

La licence Community vous rend propriétaire des sorties, distribution et commercialisation comprises, sans redevance. Une organisation dépassant un million de dollars de revenu annuel doit basculer sur la licence Enterprise, qui inclut une indemnisation juridique. Sur le site hébergé, vérifiez les droits associés à votre formule avant toute publication.

Stable Audio 3.0 peut-il générer des voix chantées ?

Non. La famille produit de la musique instrumentale, des ambiances et des effets sonores, mais ni chant ni paroles. Suno ou Udio couvrent le terrain de la chanson complète; en studio, les deux approches se complètent souvent, l'instrumental sortant de Stable Audio et la voix venant d'un vrai micro.

Quelle machine faut-il pour l'utiliser en local ?

Peu de chose pour Small: il fonctionne même sans carte graphique, via CoreML sur Mac, et compose hors ligne sur téléphone. Medium réclame un GPU avec environ 5 à 6,5 Go de mémoire vidéo selon le mode de décodage. Large n'est pas distribué en poids ouverts et reste côté serveur.

Verdict : Pas de refrain chanté ici, et c'est un choix assumé: monteurs vidéo, studios de jeu et producteurs en quête d'instrumentaux, d'ambiances et de bruitages à l'entraînement traçable tiennent avec Stable Audio 3.0 un moteur à posséder plutôt qu'à louer.

★ Outils IA de Prestige ★
IA Alternatives à Stable Audio 3.0
Gratuit
Gratuit
Gratuit
Gratuit
Gratuit
Freemium
Gratuit
Gratuit