Aller au contenu principal
Vantaige
FLUX screenshot
FLUX logo

FLUX

Freemium

FLUX est un modèle de génération d'images à partir de texte en poids ouverts (open-weight) développé par Black Forest Labs, l'équipe à l'origine de Stable Diffusion. Lancé en août 2024 avec trois niveaux d'accès, il a surpassé Stable Diffusion 3 et Midjourney v6 dans les classements de référence, et s'impose comme l'un des plus vastes écosystèmes LoRA dans le domaine de la génération d'images par IA.

Cas d'usage :Image & Art
Fonctionnalités :APIOpen Source

FLUX est une famille de modèles de génération et d'édition d'images à partir de texte, conçue par Black Forest Labs (BFL), une entreprise fondée en 2024 et basée à Fribourg-en-Brisgau, en Allemagne. BFL a été créée par Robin Rombach, Andreas Blattmann et Patrick Esser, les chercheurs qui ont développé Stable Diffusion à la LMU Munich sous la direction de Bjorn Ommer, avant de diriger la recherche sur la génération d'images chez Stability AI. L'entreprise a levé $31 million auprès d'Andreessen Horowitz et d'autres investisseurs dans le but précis de créer une nouvelle génération de modèles d'images en poids ouverts. FLUX a été lancé le 1er août 2024 sous la forme d'une suite à trois niveaux : schnell (Apache 2.0, entièrement ouvert), dev (poids ouverts non commerciaux) et pro (fermé, accessible uniquement par API). Dès la fin de son premier jour, FLUX.1 [dev] et [pro] occupaient les deux premières places du classement Artificial Analysis Text to Image Arena, devançant Stable Diffusion 3 Ultra et Midjourney v6.0.

L'architecture de base de FLUX.1 est un transformateur de flux rectifié (rectified flow transformer) mis à l'échelle à 12 milliards de paramètres, combinant des blocs de transformateurs de diffusion multimodaux et parallèles. Cette architecture offre un respect des prompts nettement supérieur à celui des modèles de diffusion latente précédents. Elle gère le rendu du texte dans les images générées, l'anatomie des mains et les scènes complexes à éléments multiples de manière beaucoup plus fiable que Stable Diffusion XL. En avril 2026, la famille de modèles s'est élargie pour inclure FLUX.1.1 [pro] (octobre 2024), FLUX.1 Tools pour l'édition contrôlée (novembre 2024), FLUX.1 Kontext pour l'édition d'images sensible au contexte (mai 2025), et FLUX.2, qui propose un modèle dev en poids ouverts de 32 milliards de paramètres (novembre 2025). FLUX est disponible pour un auto-hébergement local via Hugging Face, ou via une inférence hébergée sur Fal.ai, Replicate, Together.ai et la propre API de BFL. Des milliers de LoRA créés par la communauté sont disponibles sur Civitai pour un ajustement fin (fine-tuning) des styles personnalisés.

Ce que FLUX génère en avril 2026

FLUX couvre deux générations de modèles aux capacités distinctes. La famille FLUX.1 s'articule autour du transformateur de flux rectifié de 12B. FLUX.1 [schnell] (Apache 2.0) s'exécute en 3 à 6 étapes d'inférence et génère des images en moins de deux secondes sur du matériel moderne, ce qui est suffisamment rapide pour un prototypage en temps réel sur un GPU de jeu performant. FLUX.1 [dev] utilise la même base de 12B avec une distillation de guidage, produisant des résultats de meilleure qualité au prix d'un plus grand nombre d'étapes ; il nécessite environ 16GB de VRAM en pleine précision, avec des versions quantifiées adaptées aux cartes de 8GB. FLUX.1 [pro] est le niveau fermé, accessible uniquement par API, qui offre la meilleure qualité d'image individuelle de la famille.

La suite FLUX.1 Tools ajoute quatre modes de génération contrôlée : fill (inpainting), canny (génération guidée par les contours), depth (génération conditionnée par carte de profondeur) et redux (transfert de style à partir d'images de référence). FLUX.1 Kontext, lancé en mai 2025, a introduit l'édition sensible au contexte : téléchargez une photo, tapez "change the jacket to red" (changer la veste en rouge), et le modèle effectue une modification locale ciblée sans toucher au reste de l'image. Kontext prend également en charge la cohérence des personnages, permettant à une même personne ou à un même objet de persister de manière cohérente à travers différentes scènes, ce qui est utile pour construire des récits visuels ou des campagnes de produits homogènes. BFL affirme que Kontext s'exécute 8x plus vite que GPT-Image pour les tâches d'édition.

FLUX.2 [dev], lancé le 25 novembre 2025, fait évoluer l'architecture à 32 milliards de paramètres et est disponible en poids ouverts sur Hugging Face. BFL le décrit comme "le modèle de génération et d'édition d'images en poids ouverts le plus puissant disponible". FLUX.2 [klein], sorti le 15 janvier 2026 sous licence Apache 2.0, est une version distillée en taille générant des images en moins d'une seconde sur des GPU grand public, disponible en variantes de 4B et 9B. Toutes les générations de FLUX prennent en charge des sorties à des résolutions standard allant jusqu'à 1MP pour la plupart des niveaux, avec FLUX.2 [pro] Ultra atteignant 4 mégapixels via Fal.ai.

Où se situe FLUX par rapport à Stable Diffusion 3.5 et Midjourney

Les deux comparaisons naturelles pour FLUX sont Stable Diffusion 3.5 (l'autre grande option en poids ouverts) et Midjourney (le modèle commercial fermé dominant). Les différences mécaniques sont significatives.

FLUX vs. Stable Diffusion 3.5 Large : SD3.5 Large utilise l'architecture MMDiT (Multimodal Diffusion Transformer) avec une triple pile d'encodeurs de texte : CLIP-L, CLIP-G et T5 XXL. Avec 8,1 milliards de paramètres dans sa variante large-turbo, il fonctionne avec un calendrier d'inférence fixe de 20 étapes, contre 3 à 6 étapes pour FLUX schnell. FLUX l'emporte haut la main sur le respect des prompts, le rendu du texte à l'intérieur des images générées et l'anatomie correcte des mains, des points sur lesquels SD3 rencontre encore des difficultés. Un fil de discussion de février 2025 sur r/StableDiffusion a soulevé des inquiétudes supplémentaires quant au fait que les variantes medium et large de SD3.5 étaient "intraînables" pour l'ajustement fin des LoRA, frustrant les créateurs et poussant une grande partie de l'énergie créative de la communauté vers FLUX. Le catalogue de LoRA FLUX sur Civitai se compte désormais par milliers. SD3.5 conserve un avantage en matière de compatibilité avec certains pipelines (anciens nœuds ComfyUI et flux de travail AUTOMATIC1111) et peut fonctionner sur du matériel avec moins de VRAM dans des tailles réduites.

FLUX vs. Midjourney : Midjourney reste un leader en matière de qualité stylistique pour les esthétiques picturales et très stylisées, mais ses contraintes structurelles sont à l'opposé de celles de FLUX. Midjourney est à code source fermé, sans API publique pour la plupart des utilisateurs, sans déploiement local, sans ajustement fin de LoRA, et avec un accès limité à Discord ou à son interface web. Vous ne pouvez pas intégrer Midjourney dans le pipeline de votre propre application. Les poids ouverts de FLUX et l'API de BFL permettent un accès programmatique complet, un ajustement fin personnalisé et un déploiement auto-hébergé, ce qu'aucun de ces éléments n'est pris en charge par Midjourney. Dans les classements de référence (Artificial Analysis Arena), FLUX [pro] et Midjourney s'échangent les positions selon la catégorie d'évaluation ; FLUX l'emporte sur la fidélité aux prompts et le rendu du texte, tandis que Midjourney conserve un avantage dans certains styles artistiques spécifiques.

"Un très bon respect des prompts, une forte capacité à garder la trace de plusieurs parties d'une scène, c'est techniquement très impressionnant. Cependant, il semble n'avoir reçu aucun entraînement sur l'art pur.", vessenes, Hacker News, octobre 2024
"FLUX.1 possède un respect des prompts à la pointe de la technologie, il peut générer du texte et il est open-source. L'esthétique générale du modèle est très appréciée. Il peut créer des images réalistes ou artistiques et possède une bonne compréhension de la couleur et de la lumière.". Critique du blog Stablecog, 2024

Le coût réel de l'utilisation de FLUX

Pour ceux qui l'auto-hébergent, FLUX.1 [schnell] est sous licence Apache 2.0 et véritablement gratuit. Il n'y a aucun coût de licence ; vous ne payez que l'électricité et l'amortissement du matériel. FLUX.1 [dev] est également gratuit pour un usage personnel non commercial via la version en poids ouverts sur Hugging Face. Ces deux niveaux rendent FLUX accessible à toute personne disposant d'un GPU performant : un avantage significatif par rapport aux modèles exclusivement commerciaux.

Lors de l'utilisation de l'API hébergée de BFL, la tarification est basée sur des crédits : 1 crédit = $0.01 USD. Tarifs principaux début 2026 :

  • FLUX.2 [pro] : environ $0.03/image

  • FLUX.1 [pro] / FLUX.1.1 [pro] : $0.04/image (4 crédits)

  • FLUX.1 Kontext [pro] : $0.08/image (plus élevé en raison de la complexité de l'édition)

  • Fal.ai FLUX1.1 [pro] Ultra (4MP) : $0.06/image

Il n'y a pas d'abonnement mensuel fixe chez BFL ; il s'agit uniquement de crédits payés à l'image. Les hébergeurs tiers (Replicate, Fal.ai, Together.ai) ont leurs propres structures tarifaires et peuvent différer de quelques centimes. Pour les charges de travail en production générant des milliers d'images par mois, les coûts par image s'accumulent rapidement ; les équipes traitant de gros volumes devraient comparer leurs nombres de générations réels avec des alternatives comme Stable Diffusion auto-hébergé sur des instances cloud spot. Le coût d'entrée minimum pour l'utilisation de l'API commence autour de $0.014/image sur les niveaux plus légers, ce qui rend FLUX accessible pour des tests à petite échelle sans engagements initiaux importants.

Là où FLUX échoue systématiquement

FLUX présente de réelles limites qui reviennent régulièrement dans les discussions de la communauté. La plus notable concerne l'art classique et les styles picturaux. Lorsqu'on lui demande une "peinture à l'huile, coups de pinceau épais, lumière impressionniste" ou de produire quelque chose dans le style de Degas ou de Monet, FLUX a tendance à renvoyer des résultats influencés par l'anime ou hyper-numériques plutôt que picturaux. Les spéculations de la communauté sur HN attribuent cela à une sélection délibérée des données d'entraînement : BFL a évité de collecter massivement des œuvres d'artistes vivants après les réactions négatives auxquelles Stable Diffusion a été confronté. Le résultat est un modèle doté d'un photoréalisme exceptionnel, mais d'une gamme artistique plus restreinte que l'ancien écosystème Stable Diffusion SDXL.

La texture de la peau des portraits a suscité des critiques constantes dans les fils de discussion r/StableDiffusion : une qualité "plastique" ou excessivement lisse sur les visages en gros plan qui donne un aspect synthétique. L'ajustement fin avec des LoRA spécifiques aux portraits atténue ce problème, mais le modèle de base le présente lors de générations non guidées.

La composition spatiale complexe et la négation restent non résolues. Les prompts nécessitant plusieurs sujets dans des relations spatiales spécifiques ("trois personnages, l'un assis derrière les deux autres"), ou la négation ("une pièce sans fenêtres"), produisent encore des erreurs. Ce n'est pas propre à FLUX ; il s'agit d'une limitation au niveau de l'architecture des modèles actuels de correspondance de flux (flow-matching), mais cela mérite d'être signalé pour les flux de travail nécessitant un contrôle précis de la composition.

La limitation par la VRAM est un point de friction pratique. FLUX.1 [dev] en pleine précision nécessite 16GB de VRAM ; les versions quantifiées adaptées aux cartes de 8GB sacrifient la qualité dans les scènes complexes. FLUX.2 [dev] à 32B est encore plus exigeant. Les utilisateurs locaux occasionnels disposant de matériel de jeu de milieu de gamme (RTX 3060, 12GB) atteindront ces limites et obtiendront peut-être de meilleurs résultats pratiques avec schnell en pleine précision qu'avec dev avec des paramètres fortement quantifiés.

La licence non commerciale de FLUX.1 [dev] crée un piège subtil : le modèle en poids ouverts de la plus haute qualité ne peut légalement être utilisé dans des produits commerciaux sans passer à l'API payante. Les utilisateurs qui commencent avec dev pour le prototypage et souhaitent lancer un produit doivent soit migrer vers schnell (de qualité inférieure), soit payer pour l'API.

À qui s'adresse FLUX, et qui devrait choisir autre chose

FLUX est le bon choix pour les développeurs intégrant la génération d'images dans des applications, les chercheurs ayant besoin de poids ouverts auto-hébergeables, les artistes IA exécutant des pipelines ComfyUI locaux, et tous ceux qui souhaitent avoir la liberté d'effectuer un ajustement fin avec des LoRA sur un modèle de base à l'état de l'art (SOTA). L'écosystème Civitai pour les LoRA FLUX est désormais mature : des milliers d'adaptateurs entraînés par la communauté existent pour les styles de portraits, des esthétiques spécifiques, la photographie de produits, et bien plus encore. Si vous souhaitez construire quelque chose sur mesure à partir de la génération d'images, FLUX est la fondation en poids ouverts la plus performante disponible en avril 2026.

FLUX est également la solution idéale pour les entreprises ayant besoin d'un accès API à une génération d'images de qualité production avec une tarification à l'image, sans s'enfermer dans l'écosystème propriétaire de Midjourney.

Passez votre chemin si vous êtes un utilisateur occasionnel à la recherche d'une application web grand public simple pour générer des images de temps en temps : FLUX ne dispose pas de son propre produit grand public abouti. Vous devrez utiliser une interface utilisateur tierce (Fal.ai, l'interface web de Replicate, ou une configuration ComfyUI locale). Évitez-le également si votre cas d'usage principal est de reproduire l'esthétique de la peinture classique ; le modèle présente des lacunes documentées dans ce domaine, et un checkpoint SDXL fortement ajusté pourrait mieux convenir. Si la VRAM est une contrainte à 8GB, testez schnell attentivement avant de vous engager : il est rapide et gratuit, mais produit des résultats moins détaillés que [dev] sur des scènes complexes.

Avis des utilisateurs

Aucun avis pour l'instant. Soyez le premier à partager votre expérience !

Se connecter pour écrire un avis.

Présent dans les collections

Listes sélectionnées incluant FLUX.

Articles associés

Guides et articles en lien avec FLUX.