

LTX Studio est la plateforme de création vidéo par IA de Lightricks qui transforme les scripts en vidéos scénarisées avec des personnages cohérents d'une scène à l'autre. Elle fonctionne sur LTX-Video, leur modèle vidéo open source en temps réel, le plus rapide de sa catégorie sur du matériel grand public.
LTX Studio est une plateforme de création vidéo par IA développée par Lightricks Ltd., l'entreprise de Tel Aviv à l'origine de Facetune. Elle intègre le propre modèle de fondation vidéo open source de Lightricks, la famille LTX-Video / LTX-2, dans un environnement de production complet qui couvre la scénarisation, le storyboard, la génération par IA, le montage sur timeline, la cohérence des personnages, la voix off et la collaboration en équipe au sein d'une seule interface. La plateforme a été lancée en 2024 en même temps que la publication des poids du modèle sous-jacent LTX-Video, et début 2026, elle s'est développée pour intégrer des modèles tiers, notamment Google Veo 2, Veo 3.1, Kling, FLUX.2 Pro et Seedance 2.0, aux côtés de son moteur propriétaire.
Sa caractéristique la plus distinctive est la vitesse. LTX-Video, le modèle open source qui propulse la plateforme, a été le premier modèle de génération vidéo basé sur DiT à atteindre un rendu plus rapide que le temps réel : cinq secondes de vidéo en 768x512 générées en environ deux secondes sur du matériel H100, et des clips exploitables sur une RTX 4090 grand public en environ 30-35 secondes. La couche Studio ajoute le verrouillage des personnages entre les scènes, l'inpainting au niveau de l'image via Frame Brush, le contrôle de la caméra avec panoramique, inclinaison et zoom manuels, la génération de storyboards par IA à partir de scripts textuels, la sortie audio-vidéo synchronisée et une suite d'exportation prenant en charge jusqu'à la 4K à 50fps avec le mode LTX-2 Ultra. Les poids des modèles sous-jacents LTX-Video et LTX-2 sont sous licence MIT et disponibles sur Hugging Face et GitHub pour une utilisation auto-hébergée.
Ce que LTX Studio produit en avril 2026
La plateforme génère des vidéos à plusieurs niveaux de qualité selon le modèle sélectionné. Le mode LTX-2 Fast produit des clips en quelques secondes. LTX-2 Pro vise un rendu de qualité de révision. LTX-2 Ultra (disponible sur les forfaits Pro et supérieurs) pousse jusqu'à la 4K à 50fps avec un son synchronisé. Les modèles tiers élargissent encore les possibilités : Veo 2 et Kling 2.6 Pro sur les forfaits Standard ; Veo 3.1 et Kling 3.0 Pro sur les forfaits Pro ; Seedance 2.0 sur les deux.
La durée des clips varie de 6 à 15 secondes par génération. L'éditeur de timeline permet aux utilisateurs d'enchaîner les clips en séquences plus longues, la continuité des personnages et des lieux étant gérée par le moteur de cohérence de la plateforme. Le contrôle de la caméra couvre les mouvements cinématographiques standards : panoramique, inclinaison, zoom et animation basée sur des images-clés avec des références visuelles. L'outil Frame Brush permet l'inpainting sur des objets spécifiques dans une image générée, ce qui est utile pour nettoyer les artefacts d'arrière-plan sans avoir à regénérer l'intégralité du clip. La synchronisation labiale audio-vidéo est arrivée en 2026 en même temps que la sortie audio synchronisée native, ce qui signifie que le modèle peut générer un personnage qui parle avec un son correspondant en une seule passe, plutôt que de nécessiter une synchronisation en post-production.
Les formats et les résolutions varient selon le niveau du modèle. LTX-2 gère le FHD (1080p), le QHD (1440p) et l'UHD (2160p) dans les modes Fast et Pro, le niveau Ultra ciblant la 4K intégrale. Le rendu est exporté en MP4. La famille open source LTXV comprend désormais quatre variantes de modèles : 2B, 2B Distilled (le plus rapide, 3x plus rapide que la base), 13B et 13B Distilled, toutes disponibles publiquement pour un déploiement local. LTX-2.3, sorti le 5 mars 2026, est le modèle de production actuel avec 22B de paramètres, offrant des détails plus nets, un mode portrait natif et une synchronisation audio plus propre. Il est fourni avec LTX Desktop, une application de bureau open source (Apache 2.0) permettant une génération entièrement locale sur les GPU NVIDIA sous Windows et Linux, les spécifications officielles exigeant 32GB de VRAM et les versions de la communauté démontrant un rendu 1080p sur des cartes allant jusqu'à 16GB.
"Vous pourriez théoriquement créer un projet vidéo entier sans jamais quitter votre chambre.". Steve Paris, TechRadar Pro, août 2025
Où se situe LTX Studio par rapport à Runway Gen-4 et HunyuanVideo
Runway Gen-4 / Gen-4.5 (fermé, leader en qualité) : Runway Gen-4.5 est actuellement en tête du Artificial Analysis Text-to-Video Elo benchmark avec 1,247 points, surpassant LTX-2 sur la qualité globale, en particulier dans la précision physique, la simulation du poids des objets et les mouvements nuancés. Le modèle de Runway est entièrement propriétaire, sans poids ouverts. Il plafonne à une résolution de 1080p contre la 4K native de LTX-2. Runway facture $0.20-0.50/sec de vidéo générée contre $0.04-0.16/sec pour LTX-2 au niveau de l'API. La différence critique de flux de travail : Runway s'arrête à l'exportation du clip, nécessitant un logiciel de montage externe. LTX Studio regroupe le storyboard, la génération, la persistance des personnages et la voix off dans une seule interface. Pour les studios ayant besoin d'une qualité brute sur un seul clip et de photoréalisme, Runway est en tête. Pour les flux de travail de campagnes multi-scènes avec des personnages cohérents, le pipeline intégré de LTX Studio est le choix pratique.
HunyuanVideo et Mochi (poids ouverts, plus lents) : HunyuanVideo (Tencent, 13B de paramètres) et Mochi 1 (Genmo, 10B de paramètres) sont tous deux des modèles vidéo à poids ouverts qui se classent au-dessus de LTX-2 en matière d'alignement textuel et de réalisme visuel dans des évaluations indépendantes. HunyuanVideo a surpassé Luma 1.6 et Runway Gen-3 sur la qualité du mouvement et la qualité visuelle dans les études de préférence humaine. Le compromis est la puissance de calcul : HunyuanVideo prend 8-15 minutes sur une RTX 4090 pour générer un clip de 5 secondes ; Mochi prend 10-20 minutes. LTX-Video génère le même clip en 30-35 secondes, soit une différence de vitesse de 15-25x sur un matériel identique. HunyuanVideo nécessite également 27GB+ de VRAM pour des rendus de qualité ; LTX-Video 2B fonctionne sur 8GB avec l'optimisation Q8. Ni HunyuanVideo ni Mochi n'offrent de plateforme de production hébergée comparable à LTX Studio : ce sont des poids de modèles nécessitant des pipelines d'inférence auto-hébergés. Pour les développeurs prêts à sacrifier la vitesse au profit de la qualité, ce sont de solides alternatives. Pour quiconque souhaite un flux de travail de cinéaste hébergé, LTX Studio n'a pas de concurrent open source direct.
Le coût réel de la génération de vidéos avec LTX Studio
Le forfait gratuit offre 800 crédits uniques sans renouvellement. La plupart des utilisateurs épuisent cette allocation lors de leur première session de test, ce qui oblige à prendre une décision immédiate concernant la mise à niveau. Le forfait Lite (EUR 15/mois, usage personnel uniquement) fournit 8,000 crédits par mois mais n'inclut pas les droits commerciaux ni l'accès aux modèles tiers comme Veo ou Kling. L'utilisation commerciale nécessite le forfait Standard à EUR 35/mois (28,000 crédits/mois) ou supérieur.
Les crédits correspondent aux ressources informatiques consommées pendant la génération. Les rendus à plus haute résolution, les clips plus longs et les modèles premium (Veo 3.1, Kling 3.0 Pro) consomment les crédits plus rapidement que les générations de base LTX-2 Fast. La plateforme n'affiche pas le coût estimé en crédits avant qu'un utilisateur ne soumette une génération, ce qui a été la plainte la plus récurrente des utilisateurs sur les plateformes d'avis.
Free : EUR 0/mois (800 crédits uniques, usage personnel). Génération d'images et de vidéos avec les modèles LTX-2, contrôles de caméra avancés, audio vers vidéo, amélioration SDR vers HDR. Pas de renouvellement de crédits.
Lite : EUR 15/mois (EUR 12/mois facturé annuellement). 8,000 crédits/mois. Ajoute l'upscaling d'images/vidéos et le package de montage complet. Usage personnel uniquement, pas de droits commerciaux.
Standard : EUR 35/mois (EUR 28/mois facturé annuellement). 28,000 crédits/mois plus des secondes de calcul en bonus pour les 3 premiers mois. Inclut Veo 2, Kling 2.6 Pro, Seedance 2.0, les Storyboards IA et la génération de pitch decks. Licence d'utilisation commerciale. Possibilité d'acheter des crédits supplémentaires.
Pro : EUR 125/mois (EUR 100/mois facturé annuellement). 110,000 crédits/mois plus le bonus des 3 premiers mois. Ajoute les variantes Veo 3.1, Kling 3.0 Pro et 3 collaborateurs par projet. Utilisation commerciale.
Enterprise : Tarification sur mesure. Collaborateurs illimités, entraînement de modèles personnalisés, SSO, conformité GDPR/ISO/SOC 2, gestionnaire de compte dédié, versionnage multilingue, confidentialité des données renforcée.
Où LTX Studio montre systématiquement ses limites
La qualité du mouvement est le plafond le plus difficile à franchir. Le benchmark indépendant de Curious Refuge Lab a attribué à LTX-2 un 5.8/10 pour la qualité du mouvement et un 5.6/10 pour la cohérence temporelle, ses deux catégories les plus faibles. Les mouvements humains complexes, en particulier la marche, la danse et les scènes à plusieurs personnes, produisent des déformations visibles et une physique peu naturelle. Un critique a décrit l'architecture transformer comme rendant le modèle "rapide, mais oublieux" concernant les détails temporels, ce qui signifie qu'il décrit correctement les actions selon le prompt mais perd sa cohérence physique d'une image à l'autre sur des clips plus longs. Le morphing des visages pendant le mouvement des personnages reste un problème connu en avril 2026.
L'opacité du coût en crédits crée de réelles frictions au-delà de la frustration évidente. Les utilisateurs ne peuvent pas prévisualiser combien de crédits une génération va consommer avant de la soumettre. Les utilisateurs du forfait Standard ont signalé avoir épuisé leur allocation mensuelle de 28,000 crédits en quelques jours d'utilisation active lorsqu'ils travaillent avec des paramètres de qualité supérieure. Un critique a noté avoir brûlé 39 minutes de temps de calcul sur trois tentatives de génération, bien au-delà de l'utilisation attendue.
"Très cohérent en termes de personnages et de détails de lieux. Génère de très bonnes prévisions. [Le] point faible est la mauvaise reproduction des détails des personnages en mouvement et le morphing des visages.". Robert Ociepa, Product Hunt, 2025
"J'ai brûlé près de 60 % de mes crédits mensuels, puis j'ai dépensé le reste à essayer de corriger le résultat.". Natalie Nicholson, Substack (Crank That Nat), 14 mars 2026
Les ralentissements aux heures de pointe affectent la vitesse de rendu dans le cloud, même si l'architecture du modèle sous-jacent est rapide. Les créateurs de réseaux sociaux qui suivent les tendances signalent que le délai d'attente pendant les heures de bureau compromet l'avantage de la vitesse en temps réel qui rend LTX-Video si attrayant sur du matériel local. Le système de facturation a également été restructuré en 2025, passant d'une tarification à la minute de calcul à un modèle par crédits, ce qui a pris certains utilisateurs existants au dépourvu avec des frais inattendus pendant la transition. En mars 2026, Lightricks a publié LTX-2.3 aux côtés de LTX Desktop, un éditeur de bureau open source qui exécute le modèle complet localement sur les GPU NVIDIA sous Windows/Linux, offrant ainsi aux développeurs disposant d'un matériel suffisant un moyen de contourner entièrement les délais d'attente du cloud.
Meilleurs cas d'usage et scénarios à éviter
Idéal pour : Les équipes marketing et les agences qui ont besoin de produire des vidéos conceptuelles multi-scènes ou des storyboards de campagne avant d'engager de réels budgets de production. Le moteur de cohérence des personnages est authentique : il maintient la stabilité des visages, des tenues et des lieux sur des dizaines de plans générés, ce qu'aucun générateur de clips pur ne gère bien. Les cinéastes en pré-production qui testent numériquement les angles de caméra et les configurations d'éclairage avant d'arriver sur le plateau. Les développeurs qui souhaitent le modèle vidéo open source le plus rapide pour les pipelines ComfyUI locaux, en particulier lors de l'auto-hébergement sur du matériel GPU grand public. Les équipes qui ont besoin d'un pipeline de bout en bout sans avoir à assembler des outils distincts de scénarisation, de génération et de montage.
À éviter quand : Votre priorité est d'obtenir des séquences finies, de qualité diffusion, qui passent pour du contenu professionnel créé par des humains. Le plafond de qualité du mouvement et les lacunes en matière de cohérence temporelle sont visibles dans les rendus qui doivent résister à un visionnage attentif. Les générateurs de clips uniques comme Pika ou Hailuo sont plus rapides à tester et moins chers pour les créateurs qui n'ont besoin que de courts clips occasionnels sans continuité multi-scènes. Runway Gen-4 est le meilleur choix lorsque le réalisme physique et la fidélité des mouvements sont non négociables. Les développeurs qui n'ont besoin que du modèle et non de l'enveloppe de la plateforme peuvent récupérer gratuitement les poids de LTX-Video sur Hugging Face et éviter complètement l'abonnement. Les créateurs individuels ayant des charges de travail peu fréquentes ou variables trouveront la tarification de EUR 35-125/mois difficile à justifier compte tenu de la rapidité avec laquelle les crédits sont consommés avec les paramètres des niveaux commerciaux.
Avis des utilisateurs
Aucun avis pour l'instant. Soyez le premier à partager votre expérience !
Se connecter pour écrire un avis.
Présent dans les collections
Listes sélectionnées incluant LTX Studio.
Articles associés
Guides et articles en lien avec LTX Studio.

AI Video Generator Prompting: The Filmmaker's Real Workflow

Sell AI-Generated Short Films on TikTok Shop, Instagram & YouTube (2026)

Freepik AI Is Now Magnific: What Changed, What It Costs, and Whether to Stay (2026)

AI Fashion Prompts That Stay Consistent: The Working Formula (2026)

OpenAI GPT-Realtime-2 (May 2026): Pricing, Latency & 30-Min Voice Agent
