MiniMax Music 3.0: des chansons complètes de cinq minutes en poids ouverts
Mis à jour le 16 août 2026
MiniMax Music 3.0 est un modèle de génération de musique par IA signé MiniMax, le laboratoire chinois déjà derrière le générateur vidéo Hailuo. Vous lui donnez un concept, des paroles si vous en avez, et il compose, arrange et interprète une chanson complète de cinq minutes, voix incluses. Les poids se téléchargent gratuitement sur Hugging Face, l'API hébergée facturant chaque morceau à l'acte. Petit bémol pour le public francophone, l'interface et la documentation restent en anglais.
- Chansons complètes de cinq minutes, voix incluses
- Poids téléchargeables gratuitement sur Hugging Face
- Licence commerciale avec simple attribution
- Compatible ComfyUI dès le premier jour
- API publique facturée au morceau, rare en musique IA
- Pas de pistes séparées en sortie standard
- Texture instrumentale en retrait des derniers modèles fermés
- Interface et documentation en anglais uniquement
Une chanson entière d'un seul jet avec MiniMax Music 3.0
MiniMax Music 3.0 génère un morceau structuré de bout en bout, intro, couplets, refrains, pont et final compris, livré en WAV stéréo 32 kHz. Le modèle tient le thème, le rythme et l'identité vocale sur toute la durée, là où beaucoup de générateurs voient leurs instruments s'évaporer à mi-parcours. La page de démonstration officielle aligne 26 exemples répartis sur 11 genres, du funk à la bossa nova.
Sous le capot, quatre briques se répartissent la tâche. Un grand modèle de langage gère la structure globale, un second affine le détail acoustique, puis un module de flow matching et un autoencodeur variationnel reconstruisent l'onde sonore finale.
| Composant | Taille | Rôle |
|---|---|---|
| LLM global | 8 milliards de paramètres | Structure et progression du morceau |
| LLM local | 0,6 milliard | Détail acoustique fin |
| Module flow matching | 2,4 milliards | Passage vers l'espace latent audio |
| Flow-VAE | 123 millions | Décodage de l'onde finale |
Poids ouverts et licence commerciale, le pari inverse de Suno
Les poids de MiniMax Music 3.0 se récupèrent librement sur Hugging Face, sous une licence communautaire autorisant l'usage commercial avec une simple attribution. Un accord séparé avec MiniMax ne devient obligatoire qu'au-delà de 20 millions de dollars de revenus sur le projet.
En local, ComfyUI a intégré le modèle dès le premier jour et des affinages communautaires ont suivi presque aussitôt. Comptez environ 8 Go de VRAM au minimum avec le streaming de couches, 20 à 24 Go pour travailler confortablement (un vrai GPU de bureau, pas la puce d'un ultraportable).
Reste la question du niveau sonore. Les premiers comparatifs placent la richesse instrumentale sous les dernières versions de Suno, mais saluent des voix nettes et des paroles bien calées, du jamais entendu parmi les générateurs de musique IA ouverts. Et la machine reste sous votre contrôle, de l'affinage au déploiement.
MiniMax Music 3.0 gratuit, du navigateur à l'API
MiniMax Music 3.0 s'essaie sans payer par plusieurs chemins. Vous collez un refrain, décrivez l'ambiance en langage courant, et repartez quelques minutes plus tard avec un fichier audio complet.
Pour la production en volume, l'API standard facture 0,15 dollar par génération, jusqu'à cinq minutes d'audio d'un coup. En local, aucun compteur, votre carte graphique décide. La musique générative bouge vite, seul le tarif affiché sur la plateforme MiniMax fait autorité au moment de payer.
- Interface web MiniMax Audio, sans rien installer
- Démo hébergée sur Hugging Face Spaces
- Entrée API gratuite music-3.0-free, limitée à trois requêtes par minute
- Poids complets à faire tourner en local via ComfyUI
Questions fréquentes
MiniMax Music 3.0 est-il gratuit ?
Oui, en grande partie. Les poids du modèle se téléchargent sans frais sur Hugging Face et l'API comporte une entrée gratuite, music-3.0-free, plafonnée à trois requêtes par minute. La génération hébergée en volume passe par l'API payante, facturée à la chanson, et une démo libre tourne sur Hugging Face Spaces.
Peut-on utiliser les morceaux de MiniMax Music 3.0 dans un projet commercial ?
La licence communautaire MiniMax-Music3 autorise l'usage commercial à condition de créditer le modèle. Un accord séparé avec MiniMax n'est exigé que si le projet dépasse 20 millions de dollars de revenus. Avant une campagne d'envergure, relisez le texte de la licence sur Hugging Face, c'est lui qui fait foi.
MiniMax Music 3.0 ou Suno, quelle différence ?
Suno reste un service fermé accessible uniquement dans le cloud, quand MiniMax publie ses poids et documente une API publique facturée à l'acte. Côté son, les premiers comparatifs donnent l'avantage instrumental aux dernières versions de Suno, tandis que MiniMax l'emporte sur l'auto-hébergement, l'intégration produit et la maîtrise des coûts.
MiniMax Music 3.0 chante-t-il en français ?
Rien ne le confirme officiellement pour l'instant. Les démos publiées couvrent l'anglais et le mandarin, et la presse spécialisée a obtenu des voix japonaises convaincantes. Aucun test documenté en français n'a circulé à ce jour, le plus simple reste de coller vos propres paroles dans la démo gratuite pour juger sur pièce.
Verdict : Sonoriser un jeu, maquetter un refrain ou produire des fonds sonores à la chaîne sans compteur de crédits, voilà le terrain de jeu de MiniMax Music 3.0. Développeurs, vidéastes et adeptes de l'IA auto-hébergée y trouveront le premier modèle musical ouvert réellement exploitable en production.
« Un assistant IA privé gratuit orienté confidentialité, hébergé en Europe et chiffré de bout en bout. Il combine des capacités de raisonnement poussées, la génération d'images, la recherche sur le deep web et la mémoire à long terme. Il garantit par ailleurs que vos conversations ne sont pas utilisées pour entraîner des modèles »
