Qwen3.8-Max icône
Qwen3.8-Max
#9 dans Modèles LLM
4.5/5
« Le modèle d'Alibaba de très grande taille, multimodal et open source. Performe particulièrement bien dans le code, la recherche ou les tâches longues et autonomes. Avec un contexte pouvant atteindre 1 million de tokens»
En savoir plus : ChatGPT Perplexity
Gratuit 159975

Qwen3.8-Max: 2 400 milliards de paramètres et, pour la première fois, des poids à télécharger

Qwen3.8-Max est le plus gros modèle de langage multimodal publié à ce jour par l'équipe Qwen d'Alibaba, pensé pour le code et les agents de longue durée. Sous le capot, une architecture en mélange d'experts de 2 400 milliards de paramètres, dont 95 milliards actifs par requête, et une fenêtre de contexte d'un million de tokens sur l'API. Grande première pour la gamme Max, les poids se téléchargent sur Hugging Face, tandis que l'API hébergée se facture au token. Rien n'empêche de l'interroger en français, même si la documentation reste anglophone.

Avantages
  • Fenêtre de contexte d'un million de tokens sur l'API
  • Premier modèle de classe Max aux poids téléchargeables
  • API compatible avec les formats OpenAI et Anthropic
  • Très solide sur les agents autonomes de longue durée
Inconvénients
  • Version poids ouverts limitée au texte
  • Beaucoup trop lourd pour un GPU de bureau
  • Licence maison, plus stricte que l'Apache 2.0

Qwen3.8-Max enchaîne seize jours de code sans supervision

Qwen3.8-Max mène un projet logiciel du dossier vide au livrable final sur plusieurs jours de travail continu, sans main humaine dans la boucle. La démonstration retenue par Alibaba a tourné environ seize jours en autonomie, en accumulant 265 commits et 127 pull requests sur un dépôt GitHub public.

Le modèle voit aussi ce qu'il fait. Les images et la vidéo ne servent pas seulement d'entrée, elles alimentent une boucle de correction pendant l'exécution. Sur OSWorld-Verified, qui note la capacité d'un agent à piloter un vrai bureau d'ordinateur, Alibaba annonce 86,1, devant les modèles propriétaires qu'il a mesurés. Chiffres maison, donc à vérifier sur vos propres tâches, mais des classements indépendants le placent déjà tout en haut en raisonnement.

Le géant d'Alibaba passé au banc d'essai en français
Qwen3.8-Max face à Kimi K3 sur du code réel

Des poids sur Hugging Face, avec une licence à lire de près

Les poids complets de ce mélange d'experts sont téléchargeables sur Hugging Face et ModelScope sous le nom Qwen3.8-2.4T-A95B, du jamais vu pour un modèle de classe Max chez Alibaba. Une variante FP8 accompagne le dépôt, et la licence maison prévoit un partage de revenus pour les plus gros déploiements commerciaux.

Petite précaution avant de libérer de l'espace disque (les forums en ont d'ailleurs discuté avec vigueur), la version ouverte ne recopie pas trait pour trait le service hébergé. Le tableau ci-dessous résume l'écart.

CaractéristiqueAPI hébergéePoids ouverts
Entrées acceptéesTexte, images, vidéoTexte seul
Contexte1 million de tokens262 K natif, 1 M via YaRN
CoûtFacturation au tokenTéléchargement gratuit
LicenceConditions du service AlibabaLicence maison avec partage de revenus

Brancher Qwen3.8-Max sur vos outils sans rien réécrire

L'API de Qwen3.8-Max suit les formats OpenAI et Anthropic, elle fonctionne donc directement avec les assistants de code du marché comme Claude Code, Codex ou Qwen Code. Vous pointez votre SDK vers le nouveau point d'accès, vous changez l'identifiant du modèle, et le tour est joué.

Côté facture, comptez 2 dollars le million de tokens en entrée et 6 dollars en sortie, avec un cache implicite à 0,25 dollar, sous le prix catalogue du précédent Qwen3.7-Max. Ces montants bougent au fil des annonces, la grille officielle d'Alibaba Cloud garde donc le dernier mot.

  • QwenCloud et Alibaba Cloud Model Studio pour l'accès direct
  • OpenRouter et la passerelle IA de Vercel pour un essai en deux minutes
  • Hugging Face et ModelScope pour l'auto-hébergement

Questions fréquentes

Qwen3.8-Max est-il gratuit ?

Le téléchargement des poids sur Hugging Face ne coûte rien, mais il faut fournir le serveur qui va avec. L'API hébergée se facture au million de tokens, et des formules d'abonnement à crédits existent aussi chez Alibaba. Pour un simple essai sans compte Alibaba, passer par OpenRouter reste la voie la plus rapide.

Peut-on utiliser Qwen3.8-Max dans un projet commercial ?

Oui via l'API, comme n'importe quel service hébergé. Pour les poids ouverts, la licence diffère de l'Apache 2.0 des anciens Qwen et prévoit un partage de revenus pour les très gros déploiements commerciaux, avec un seuil encore en cours de finalisation. Lisez le texte de licence du dépôt avant toute mise en production.

Qwen3.8-Max ou Kimi K3, lequel choisir ?

Kimi K3 aligne 2 800 milliards de paramètres et des scores audités par des évaluateurs indépendants, mais ses tokens de sortie coûtent deux fois et demie plus cher. Qwen3.8-Max revient nettement moins cher et s'est montré plus discipliné dans le seul face-à-face tiers publié, avec zéro appel d'outil raté au compteur.

Quel matériel faut-il pour faire tourner Qwen3.8-Max en local ?

Un serveur multi-GPU de classe datacenter, rien de moins. Avec 2 400 milliards de paramètres au total, le modèle joue dans la même cour de déploiement que Kimi K3 ou GLM-5.2, loin du GPU de salon. Une variante FP8 allège la mémoire, et un petit frère de 27 milliards de paramètres a été annoncé pour les machines ordinaires.

Verdict : Confier un dépôt entier à un agent qui travaille plusieurs jours d'affilée, voilà le terrain de jeu de Qwen3.8-Max. Les équipes d'ingénierie qui veulent un modèle de pointe hébergeable dans leur propre infrastructure, avec des points d'accès que leurs outils parlent déjà, y trouveront un allié sérieux.

★ Outils IA de Prestige ★
IA Alternatives à Qwen3.8-Max
Payant
Payant
Gratuit
Payant
Gratuit
Payant
Payant
Freemium