Qwen-Image 2.1: des images transparentes natives dans un modèle ouvert de 7 milliards de paramètres
Mis à jour le 24 septembre 2026
Qwen-Image 2.1 est le modèle d'image ouvert d'Alibaba, capable de générer et de modifier des images dans un seul réseau dont le composant de génération visuelle pèse 7 milliards de paramètres. Sa carte maîtresse, la production directe d'images transparentes RGBA, sans étape de détourage. Les poids se téléchargent gratuitement, mais la licence limite l'usage à la recherche, un point à lire avant tout projet commercial. Bonne surprise côté francophone, son module de réécriture de prompts comprend les consignes rédigées en français.
- Images transparentes RGBA générées sans détourage
- Jusqu'à 10 images de référence en entrée
- Sortie native en 2K, typographie soignée
- Pris en charge par ComfyUI dès sa sortie
- Tourne en local d'après les premiers retours
- Licence recherche, usage commercial soumis à autorisation
- Aucun chiffre officiel de VRAM, réglages à tâtonner
- Documentation technique en anglais uniquement
Une image transparente RGBA qui sort prête à composer
Qwen-Image 2.1 génère nativement des images RGBA, avec un vrai canal alpha, là où la plupart des modèles imposent un passage par un outil de suppression d'arrière-plan. Le modèle choisit selon votre prompt entre image classique et image transparente, retouche un calque déjà détouré en gardant son fond vide, et extrait le sujet d'une photo ordinaire en élément isolé. Vous envoyez le cliché d'une paire de baskets, vous demandez le produit seul, et le packshot ressort détouré en 2K.
Le reste de la fiche technique tient en quelques lignes.
| Tâche | Ce que permet Qwen-Image 2.1 |
|---|---|
| Texte vers image | Sortie native en 2K, plusieurs formats |
| Image transparente | Canal alpha généré directement, calques modifiables |
| Édition locale | Zones désignées par cercles, masques ou coups de pinceau |
| Multi-références | Jusqu'à 10 images en entrée, portraits de groupe ou essayage virtuel |
| Extraction de sujet | Un objet sorti d'une photo en calque RGBA |
Qwen Image et la génération d'images open source face aux modèles fermés
Selon Alibaba, Qwen-Image 2.1 dépasse la plupart des modèles fermés sur son propre benchmark, y compris Nano Banana 2.0 de Google, des évaluations indépendantes restant attendues. La prudence s'impose donc, même si un détail retient l'attention, toujours d'après ce classement interne, tous les modèles ouverts du tableau, FLUX 2 compris, passent derrière lui.
La course des modèles texte vers image se joue d'habitude à coups de dizaines de milliards de paramètres, et Alibaba prend le contre-pied avec un moteur nettement plus léger. Face aux services hébergés comme Seedream 4.0 ou ChatGPT Images 2.0, l'argument n'est pas le score. C'est le contrôle, tout tourne sur votre machine.
Qwen-Image 2.1 sur votre carte graphique, avec la licence en petits caractères
Les poids ouverts publiés sont disponibles sur Hugging Face, GitHub et ModelScope, avec une démo en ligne et une prise en charge de ComfyUI et Diffusers dès le premier jour. Selon les premiers retours, le modèle tourne sur une carte grand public solide type RTX 3090, et des versions quantifiées abaissent encore la mémoire demandée. Aucun chiffre officiel de VRAM n'ayant été publié, prévoyez quelques essais.
Reste le chapitre qui fâche. La licence Qwen Research couvre la recherche et l'évaluation, rien de commercial, et un usage marchand passe par une licence Qwen séparée à demander par e-mail (les habitués de l'Apache 2.0 des versions précédentes relèveront le changement de régime). L'accès dans Qwen Chat et une éventuelle tarification via Alibaba Cloud restent à vérifier sur les canaux officiels.
Questions fréquentes
Qu'est-ce que Qwen-Image 2.1 ?
Qwen-Image 2.1 est le modèle d'image ouvert d'Alibaba, qui réunit génération et édition dans un seul réseau dont le composant visuel compte 7 milliards de paramètres. Il produit des images transparentes RGBA en natif, sort du 2K, accepte jusqu'à 10 images de référence, et ses poids se téléchargent sur Hugging Face, GitHub et ModelScope.
Qwen-Image 2.1 est-il gratuit et utilisable commercialement ?
Gratuit à télécharger et à faire tourner, oui, mais pas utilisable commercialement en l'état. La licence Qwen Research limite l'usage à la recherche et à l'évaluation, et un projet marchand exige une licence séparée à demander par e-mail auprès d'Alibaba, avec une mention Built with Qwen dans la documentation. Les versions précédentes étaient sous Apache 2.0, d'où la confusion fréquente.
Quelle carte graphique faut-il pour Qwen-Image 2.1 ?
Aucun chiffre officiel de VRAM n'est publié par Alibaba. Selon les premiers retours, le modèle tourne sur une carte grand public solide comme la RTX 3090 ou la RTX 4090, les versions quantifiées et GGUF réduisent encore la mémoire requise, et le code officiel sait décharger une partie du modèle vers la RAM pour les cartes plus modestes.
Qwen-Image 2.1 ou Nano Banana 2, lequel choisir ?
Tout dépend de l'endroit où le modèle doit tourner. Nano Banana 2.0 est un service hébergé de Google, tandis que Qwen-Image 2.1 s'installe sur votre propre machine et génère la transparence RGBA en direct. Selon Alibaba, sur son propre benchmark, il devance légèrement son rival, les évaluations indépendantes restant attendues.
Verdict : Pour fabriquer en local des logos, des stickers et des packshots déjà détourés, ce petit modèle fait le travail de deux outils. Chercheurs, bidouilleurs ComfyUI et équipes prêtes à demander la licence commerciale y trouveront un terrain d'expérimentation très sérieux.
« Un assistant IA privé gratuit orienté confidentialité, hébergé en Europe et chiffré de bout en bout. Il combine des capacités de raisonnement poussées, la génération d'images, la recherche sur le deep web et la mémoire à long terme. Il garantit par ailleurs que vos conversations ne sont pas utilisées pour entraîner des modèles »
