

Leonardo AI propose l'une des plateformes de génération d'images les plus performantes en 2026, avec un rendu de texte exceptionnel, l'entraînement de modèles personnalisés et un canevas intégré, mais son économie de jetons est confuse et ses filtres de contenu bloquent beaucoup trop souvent des prompts légitimes.
Prompt : « un château fantastique en ruines à l'aube, cinématique, portes en pierre avec l'inscription 'WELCOME TO VANTAIGE' gravée au-dessus de l'entrée. » Nous l'avons testé sur le modèle Phoenix de Leonardo, Midjourney v6 et Flux en avril 2026. Phoenix a fourni une inscription lisible dès la première tentative, avec des lettres précises incrustées dans une pierre sculptée très réaliste. Midjourney v6 a produit un éclairage plus dramatique et une atmosphère plus picturale, mais le texte s'est dissous en un charabia aux allures fantastiques. Flux a égalé Phoenix sur le photoréalisme, mais a généré une texture de pierre différente qui ne correspondait pas au cadre médiéval du prompt. Ce test illustre parfaitement l'utilité réelle de Leonardo en 2026 : ce n'est pas le générateur d'images le plus esthétique, mais le plus fiable pour les prompts où le contenu de l'image doit correspondre exactement à ce que vous avez écrit.
Leonardo AI a été lancé en 2022 et racheté par Canva en juillet 2024 alors qu'il comptait 19 millions d'utilisateurs, pour atteindre 30 millions en 2025. Il opère de manière indépendante sous l'égide de Canva, avec un produit grand public et une Creative Engine API destinée aux développeurs. Le modèle phare, Phoenix, repose sur une architecture fondatrice propriétaire, et non sur un ajustement (fine-tune) de Stable Diffusion, ce qui explique en grande partie son comportement différent lors de la génération.
La signature visuelle de Leonardo en avril 2026
Phoenix produit des images photoréalistes en haute résolution avec une forte cohérence par rapport au prompt : les éléments décrits apparaissent dans la disposition que vous avez spécifiée plutôt que sous la forme d'une interprétation libre. Le traitement des couleurs s'oriente par défaut vers des tons riches et saturés, sans l'aspect sur-traité commun aux autres outils d'IA. Il gère les détails fins comme le tissage des tissus, les ornements architecturaux et, surtout, le texte intégré, mieux que n'importe quel outil concurrent dans cette gamme de prix.
La sélection du modèle est importante car le bon choix dépend fortement de ce dernier. Kino XL est le spécialiste du rendu cinématique : formats larges, éclairages dramatiques, compositions atmosphériques, et il performe bien sans prompts négatifs. Vision XL gère les scènes détaillées et les portraits, récompensant les prompts descriptifs plus longs. RPG 4.0 est optimisé pour les portraits de personnages et l'art fantastique ; il est devenu la référence de la communauté pour les concepts arts de jeux indépendants. Anime XL couvre l'esthétique manga mais reste le modèle interne le moins constant, les tests utilisateurs notant que « les proportions du visage et l'échelle semblent incorrectes sans ajustement du prompt » (skywork.ai, 2025).
Au-delà des modèles, la plateforme inclut un canevas pour l'inpainting et la fusion, un Universal Upscaler jusqu'à 4x, Motion 2.0 pour la génération d'image vers vidéo avec contrôles de caméra, et le Flow mode pour une génération continue à partir d'un seul prompt. L'ensemble du flux de travail (générer, affiner, inpainting, upscaling) reste dans un seul onglet. Les critiques soulignent régulièrement que les utilisateurs « ont rarement besoin de quitter le tableau de bord de Leonardo » pour leurs travaux d'édition (aiflowreview.com, 2025).
Les prompts qui fonctionnent vraiment (et leurs particularités)
Phoenix récompense la spécificité plutôt que la brièveté. Un prompt tel que « mockup de produit, flacon de sérum de soin sur marbre blanc, lumière de studio douce venant de la gauche, l'étiquette indique 'GLOW SERUM NO. 4' en police sans-serif épurée » produira systématiquement une étiquette lisible, une capacité qui nécessitait auparavant un compositing en post-production. Phoenix gère des flux de travail de mockups de marque qui sont peu fiables sur Midjourney, DALL-E 3 ou les générations précédentes de Leonardo.
Kino XL réagit aux références de cadrage cinématique de manière plus fiable que si l'on donne des descriptions de caméra à Phoenix. Un prompt comme « plan d'ensemble large, vallée de montagne à l'heure dorée, lens flare anamorphique, esthétique de plan de film » produira un paysage et une atmosphère qui semblent composés plutôt que générés. La particularité clé : surcharger un prompt Kino XL avec des détails de personnages l'éloigne de ses points forts atmosphériques. Considérez-le comme un modèle de lieu et d'éclairage, et non comme un modèle de personnage.
RPG 4.0 brille avec les prompts de personnages fantastiques faisant référence à des équipements spécifiques et des indices stylistiques : « voleur demi-elfe, armure en cuir avec bordure émeraude, capuche baissée, portrait de trois quarts, éclairage dramatique par le bas, composition de carte de personnage RPG ». Les développeurs indépendants gérant des pipelines d'assets de jeu l'utilisent pour générer 20 à 30 variations d'un type de personnage en une seule session avec un LoRA de style, puis les sélectionnent manuellement pour les affiner. Le style de sortie est délibérément orienté vers l'illustration, il ressemble à un concept art et non à une référence photo, ce qui correspond exactement aux besoins de ce cas d'usage.
Là où Leonardo a des difficultés : les mains, le texte, la cohérence
Le système de modération de contenu est l'obstacle pratique le plus important pour les utilisateurs payants, et la réaction de la communauté va bien au-delà du simple « cas particulier frustrant ». Des utilisateurs payants du niveau Artisan ont été bloqués sur des mots comme « ville », « cauchemar » et « robe transparente » en pleine session, sans voie de recours claire ni explication sur l'élément ayant déclenché le filtre. Le filtre opère à la fois au niveau du prompt et du résultat, ce qui signifie qu'une image peut passer la vérification textuelle et être tout de même bloquée après génération. Cette incohérence le rend systématiquement peu fiable : le même vocabulaire peut fonctionner dans une variante de prompt et échouer dans une autre très similaire. Les utilisateurs travaillant dans la mode, la fiction d'horreur, la photographie urbaine, ou tout ce qui implique des descriptions de tissus ou un vocabulaire à thème sombre, y seront régulièrement confrontés. Certains utilisateurs expérimentés ont migré vers Flux via ComfyUI spécifiquement pour y échapper.
« Des utilisateurs payants du niveau Artisan ont été bloqués sur des mots comme 'ville', 'cauchemar' et 'robe transparente', et il existe une incohérence documentée dans la façon dont les filtres s'appliquent à des prompts démographiquement similaires. Le verdict de la communauté n'est pas 'cas particulier frustrant', c'est 'censure hors de contrôle', et certains utilisateurs sont partis à cause de cela. », agrégé depuis r/LeonardoAI, tel que cité dans aioptimistic.com, 2025
Les mains des personnages sont sujettes aux erreurs sur les poses complexes, acceptables sur les positions de repos simples, et peu fiables sur les compositions à plusieurs mains ou avec des doigts qui se chevauchent. Spécifier une position de main simple dans votre prompt peut aider. Ce n'est pas un échec spécifique à Leonardo, mais la qualité générale des résultats de Phoenix suscite des attentes que le problème des mains vient systématiquement doucher.
La cohérence des personnages au niveau des traits fins est une limitation reconnue, même lors de l'utilisation du Character Engine :
« Ce n'est pas encore parfait à 100 %, parfois les cheveux changent. », aitoolanalysis.com, 2025
Motion 2.0 ajoute des contrôles de caméra et la prise en charge des prompts, et tient la route à une intensité faible à moyenne. Aux paramètres maximums, l'anatomie s'effondre, les têtes se détachent, l'architecture fond. La plage d'intensité utilisable pour toute image avec des sujets reconnaissables se situe bien en dessous du maximum du curseur.
Utilisation commerciale : licences, droits d'auteur et filtres de sécurité
Les abonnés payants de Leonardo possèdent les droits sur leurs images générées et peuvent les utiliser à des fins commerciales. Les images du niveau gratuit (Free) sont visibles publiquement dans la galerie de la communauté par défaut, ce qui les rend inadaptées au travail client ou aux images de pré-lancement. Le niveau Apprentice (12 $/mois) génère de manière privée et constitue le niveau minimum pour un usage commercial.
Canva s'est engagé à exploiter les plateformes séparément ; le contenu des utilisateurs n'est pas partagé entre Leonardo et Canva à moins que vous n'y consentiez explicitement. La Creative Engine API utilise la même politique de contenu que le produit grand public. Pour la plupart des générations d'images commerciales (photographie de produits, illustration marketing, art éditorial, couvertures de livres), le niveau de modération est gérable avec une formulation prudente des prompts. Pour le contenu pour adultes, l'horreur ou les travaux de mode matures, Leonardo est effectivement hors de question, quel que soit le niveau d'abonnement. Il s'agit d'une décision produit délibérée qui a peu de chances de changer sous la direction de Canva.
Flux de travail de la communauté sur Reddit et Discord
Le pipeline d'assets de jeux indépendants est le flux de travail communautaire le plus documenté de Leonardo. Le modèle : entraîner un LoRA de style sur 15 à 20 images conceptuelles établissant le langage visuel de votre jeu, puis utiliser RPG 4.0 ou Phoenix avec ce LoRA pour générer des assets spécifiques à la scène. « Générer 20 variations de boucliers médiévaux ou de drones de science-fiction en une seule session » (flowith.io, 2025) relève de la production standard plutôt que de l'exception. L'inpainting du canevas gère les changements d'arrière-plan sans réentraînement. Aucun outil plus simple ne reproduit cela de bout en bout. Midjourney manque de fine-tuning, Adobe Firefly manque de spécificité de modèle, la génération d'images de ChatGPT manque de canevas.
Les auteurs indépendants et les petits éditeurs ont trouvé un flux de travail connexe pour le prototypage de livres illustrés : entraîner un LoRA sur un style de personnage défini, générer chaque scène de page à l'aide de ce modèle, et livrer un prototype illustré complet de 24 à 32 pages pour approbation par le client en une seule journée, avant d'engager le moindre budget pour un illustrateur humain. Le coût aux tarifs des jetons Artisan équivaut à peu près à un ou deux mois d'abonnement par prototype de livre, mais cela permet de condenser la décision « cette direction visuelle est-elle la bonne ? » à la phase de pré-production.
Le Flow mode, une génération continue à partir d'un seul prompt, est utile pour une exploration rapide mais est constamment cité comme le moyen le plus facile d'épuiser une allocation mensuelle de jetons. Le conseil de la communauté : fixez une limite de génération avant de commencer une session Flow. La plateforme ne vous avertit pas de manière bien visible lorsque vous approchez de votre plafond mensuel.
Leonardo vs. Midjourney vs. Flux
La comparaison entre Leonardo et Midjourney est celle que les utilisateurs font réellement, et Reddit s'est arrêté sur une division pragmatique. Les utilisateurs qui privilégient la cohérence, le contrôle et les résultats prêts pour la production penchent pour Leonardo. Les utilisateurs qui recherchent le plus grand impact esthétique, une atmosphère picturale, une ambiance cinématique et un aspect visuel dramatique penchent pour Midjourney. De nombreux créateurs expérimentés utilisent les deux : Leonardo pour les assets de production, Midjourney pour le brainstorming et les images phares (hero shots). Midjourney n'a pas de plan gratuit ni d'accès API pour la plupart des utilisateurs ; Leonardo l'emporte sur l'accessibilité et la profondeur du flux de travail. Le prestige esthétique et la qualité brute des résultats de Midjourney restent supérieurs pour les travaux à vocation artistique où la fidélité exacte au prompt compte moins que l'impact visuel.
Flux a émergé comme le challenger le plus direct de Phoenix pour le photoréalisme brut, sans canevas, sans vidéo et sans entraînement de personnages, mais aussi sans filtres de modération de contenu. Les utilisateurs bloqués par le système de Leonardo citent de plus en plus Flux via ComfyUI ou des hébergeurs tiers comme leur porte de sortie. Si votre flux de travail se résume à de la génération d'images simple et que les frictions liées à la modération sont le problème bloquant, Flux y répond proprement. Si vous avez besoin du canevas, de la vidéo ou de l'écosystème de modèles de la communauté, Flux appartient à une catégorie de produits différente, ce n'est pas un remplaçant.
Leonardo est la plateforme de génération d'images la plus complète pour les utilisateurs qui ont besoin de toute la panoplie dans une seule interface. Midjourney l'emporte sur le rendu esthétique maximal. Flux l'emporte pour les utilisateurs pour qui la modération est rédhibitoire. Leonardo l'emporte lorsque l'ensemble du flux de travail compte plus qu'une simple image.
L'économie des crédits : ce que coûte un vrai projet
Le coût en jetons varie selon le modèle, la résolution et la fonctionnalité. Une génération standard avec Phoenix en 1024x768 coûte environ 10 à 15 jetons. L'activation de l'affinage Alchemy double approximativement ce chiffre. Le Flow mode consomme des jetons en continu. Les clips Motion 2.0 coûtent des centaines de jetons chacun. Les modèles vidéo tiers (Veo 3, Sora 2) coûtent l'équivalent de plus de 300 générations d'images standard par clip de 8 secondes.
« Presque tout ce que vous faites sur la plateforme, de la création d'une image basique à la génération d'une vidéo, a un coût en jetons. Le coût en jetons pour différentes actions peut varier énormément, et cela prend souvent les nouveaux utilisateurs par surprise. », eesel.ai, 2025
Concrètement : les 8 500 jetons mensuels du plan Apprentice permettent de générer environ 500 à 850 images nettes. Ajoutez l'affinage régulier d'Alchemy et l'upscaling, et cela tombe à 200–350 images finalisées. Lancez une session Veo 3 et vous pourriez dépenser 20 % de votre allocation mensuelle pour cinq clips. C'est pourquoi un marché gris de revendeurs de jetons a émergé sur Reddit à environ 90 % de réduction par rapport aux prix officiels, un signe que l'économie officielle est insoutenable pour les gros utilisateurs.
La transition de Leonardo en 2026 vers le Pay-As-You-Go pour les nouveaux utilisateurs répond directement à ce problème : les crédits se chargent manuellement ou via une recharge automatique, les soldes n'expirent pas, et vous payez pour ce que vous consommez. Les abonnés existants peuvent changer à tout moment en annulant leur abonnement ; les jetons restants sont convertis en un solde PAYG sans expiration. Pour les utilisateurs travaillant par projets qui génèrent par rafales, le PAYG est plus adapté. Pour une utilisation quotidienne régulière, les niveaux d'abonnement offrent toujours une meilleure valeur par jeton à grande échelle.
Avis des utilisateurs
Aucun avis pour l'instant. Soyez le premier à partager votre expérience !
Se connecter pour écrire un avis.
Présent dans les collections
Listes sélectionnées incluant Leonardo AI.
Articles associés
Guides et articles en lien avec Leonardo AI.

Freepik AI Is Now Magnific: What Changed, What It Costs, and Whether to Stay (2026)

Wix Logo Maker Review (2026): Real Costs, the Edit Catch, and AI Alternatives

Google Vision AI Explained (2026): Pricing Per 1,000 Units, Free Tier, and Alternatives

AI Fashion Prompts That Stay Consistent: The Working Formula (2026)

AI Video Generator Prompting: The Filmmaker's Real Workflow
