LTX-2 rapatrie la vidéo 4K sonorisée du cloud vers votre propre carte graphique
LTX-2 est un modèle open source de génération vidéo développé par Lightricks, l'éditeur de Facetune et de LTX Studio. Il fabrique l'image et la bande-son en une seule passe: dialogues, bruitages et ambiances tombent pile au bon moment. Annoncé en octobre 2025, il a vu ses poids complets publiés quelques semaines plus tard, en téléchargement libre. La sortie atteint la 4K native à 50 images par seconde, en local sur une carte grand public ou via une API facturée à la seconde.
- Audio et vidéo générés ensemble, synchronisés
- Poids, code et outils d'entraînement publiés
- 4K native jusqu'à 50 images par seconde
- Tourne en local sur une carte grand public
- Installation locale gourmande en VRAM et en stockage
- Photoréalisme parfois en retrait face aux modèles fermés
- Clips courts, une dizaine de secondes par génération
L'image et le son sortent de la même passe
LTX-2 repose sur un modèle de diffusion à deux flux, 14 milliards de paramètres pour la vidéo et 5 pour l'audio, reliés par des couches d'attention croisée. Résultat très concret: une porte qui claque à l'écran claque aussi dans la bande-son, et les lèvres suivent le dialogue sans retouche.
Vous tapez une description ou déposez une image de référence, vous choisissez durée et définition, et le clip sort avec son mixage intégré. La version 2.3 a resserré les boulons au passage: détails plus nets, mouvements plus stables, format vertical pris en charge.
LTX-2 chez vous: poids ouverts, ComfyUI et LTX Desktop
Tout le nécessaire pour faire tourner le modèle sans le cloud est public, une transparence encore rare parmi les projets IA open source. La licence communautaire couvre l'usage commercial tant que l'entreprise reste sous 10 M$ de chiffre d'affaires annuel; au-delà, une licence dédiée s'applique.
Le paquet publié comprend:
Côté machine, comptez une carte NVIDIA avec 32 Go de VRAM pour être à l'aise sous Windows, et environ 150 Go de modèles au premier lancement (prévoyez un café, pas une pause de cinq minutes). Ensuite, plus aucune facturation par clip.
- Les poids complets du modèle, upscalers compris
- Le code d'inférence et les pipelines de production
- Un module d'entraînement LoRA pour vos propres styles
- Des nodes ComfyUI officiels et l'application LTX Desktop
Où se situe le modèle face à Veo, Kling et Seedance 2.0
Face à Veo 3.1, Seedance 2.0 ou Kling 3.0, tous fermés et facturés au crédit, LTX-2 joue la carte du contrôle: un pipeline inspectable, ajustable et déployable sur votre infrastructure. Les comparatifs publiés le placent en tête sur le terrain des gros volumes et des équipes techniques, quand les modèles propriétaires conservent souvent une longueur d'avance sur le photoréalisme pur.
Quatre chemins mènent au modèle, du plus artisanal au plus confortable. Les conditions évoluant au rythme des versions, la page officielle de ltx.io reste la seule source à consulter avant de sortir la carte bancaire.
| Voie d'accès | Matériel requis | Facturation |
|---|---|---|
| Poids ouverts (Hugging Face, ComfyUI) | GPU NVIDIA musclé, réglages manuels | Aucune par clip |
| LTX Desktop | Windows ou Mac, 32 Go de VRAM conseillés | Aucune en local |
| API (Fal, Replicate, LTX) | Rien, tout tourne dans le cloud | À la seconde générée |
| LTX Studio | Un simple navigateur | Crédits et abonnement |
Questions fréquentes
LTX-2 est-il gratuit ?
Oui, les poids se téléchargent librement et la génération locale ne coûte rien par clip. La licence communautaire autorise l'usage commercial jusqu'à 10 M$ de chiffre d'affaires annuel. Seuls l'API, facturée à la seconde de vidéo, et la plateforme LTX Studio avec ses crédits sont payants.
LTX-2 ou Google Veo, lequel choisir ?
Les deux ne jouent pas la même partition. Veo 3.1 vise le rendu cinématographique clé en main dans le cloud de Google, tandis que LTX-2 mise sur les poids ouverts, l'exécution locale et un coût par clip nul une fois le matériel amorti. Gros volumes, données sensibles ou fine-tuning: l'ouverture pèse lourd.
LTX-2 fonctionne-t-il sur Mac ?
Oui, via le backend Metal (MPS) de PyTorch sur puces Apple Silicon. Un MacBook Pro M4 Max bien doté en mémoire unifiée encaisse la 4K, environ deux fois plus lentement qu'une RTX 4090, et les puces plus modestes se limitent au 1080p. LTX Desktop existe aussi en version macOS, avec bascule possible vers l'API.
Peut-on entraîner LTX-2 sur ses propres images ?
Oui, le dépôt officiel inclut un entraîneur LoRA pour adapter le modèle à un style, un personnage ou un produit maison. Le code d'entraînement complet est publié, ce que très peu de modèles vidéo proposent, fermés comme ouverts.
Verdict : Zéro compteur de crédits et un pipeline entièrement inspectable: l'argument parle aux studios indépendants qui enchaînent les clips, aux équipes produit qui intègrent la vidéo dans leurs applications et aux bidouilleurs équipés d'un bon GPU.
