Aller au contenu principal
Vantaige
Midjourney screenshot
Midjourney logo

Midjourney

Payant
4.5(1)

Midjourney est un générateur d'images (et de courtes vidéos) par IA payant, réputé pour ses rendus cinématographiques et immersifs. Depuis le 2 septembre 2026, le modèle par défaut est la V8.2. Il n'existe pas d'offre gratuite - les forfaits débutent avec Basic à 10 $/mois, et la génération d'images privées requiert le mode Stealth des forfaits Pro ou Mega.

Fonctionnalités :V7V8 AlphaNiji 6Style Reference --srefCharacter Reference --crefOmni Reference --orefPersonalization --pV1 VideoEditor (inpaintoutpaint)Mood BoardsStealth Mode

Prompt : "cinematic photo of an abandoned Tokyo arcade at 3am, neon reflections on wet pavement, 35mm film grain, --ar 16:9 --v 7". Les quatre variations sont revenues en moins d'une minute. Aucune d'entre elles ne ressemblait à une photographie. Chacune ressemblait à un souvenir, des néons cyan-magenta-ambre se reflétant sur le bitume mouillé, des formes de bornes d'arcade au rendu impressionniste, un registre tonal si fidèle à la nostalgie nocturne de Tokyo que vous l'utiliseriez sans hésiter. Aucun texte lisible sur les écrans des bornes. Aucune signalétique de marque précise. Juste l'atmosphère, parfaitement saisie, du premier coup. C'est le compromis fondamental de Midjourney en avril 2026 : il interprète plutôt qu'il n'exécute, et l'interprétation est généralement meilleure que ne l'aurait été la version littérale.

Midjourney, Inc. est une entreprise privée de San Francisco avec plus de $500M de revenus annuels récurrents (ARR) et aucun investissement extérieur. Le modèle par défaut est la V7 (lancée en avril 2025). La V8.1 Alpha est entrée en préversion sur alpha.midjourney.com en avril 2026. L'interface principale est midjourney.com ; un bot Discord reste fonctionnel mais devient de plus en plus obsolète. Il n'y a pas de version gratuite, supprimée en mars 2023 et jamais réintroduite.

La signature visuelle de Midjourney en avril 2026

L'esthétique maison de la V7 est saturée, cinématographique et atmosphérique d'une manière que les modèles concurrents n'ont pas réussi à reproduire. Les couleurs sont riches mais maîtrisées, sublimées comme sur une image de film, et non criardes comme les premières productions de l'IA. L'éclairage obéit à une logique dramatique : Midjourney ajoute des indices de profondeur, un éclairage à contre-jour et une perspective atmosphérique à des scènes qui ne le demandaient pas explicitement. C'est le « look Midjourney », et pour de nombreux travaux créatifs professionnels, c'est exactement ce que veulent les clients.

La V7 a introduit plusieurs améliorations techniques par rapport à la V6.1. La personnalisation est désormais activée par défaut (nécessite d'évaluer au moins 40 images pour la débloquer ; 200+ pour une cohérence fiable). Le Draft Mode réduit le temps de génération par 10 et le coût GPU de moitié. L'Omni Reference (--oref), lancé le 3 mai 2025, intègre un personnage, un objet ou une créature spécifique d'une image de référence dans de nouvelles scènes. Le Character Reference (--cref) capture les traits du visage et éventuellement les vêtements de n'importe quel portrait. Le Style Reference (--sref) applique la palette de couleurs, la texture et l'ambiance lumineuse de n'importe quelle image, ou un code numérique de la communauté, à un nouveau prompt. Ces trois systèmes de référence, combinés au paramètre de personnalisation (--p), font de la V7 la version de Midjourney la plus configurable à ce jour sans nécessiter d'outil tiers.

La V8.1 Alpha, présentée en préversion en avril 2026, ajoute un rendu de texte plus net, une sortie native en 2K et un outil Style Creator. La réaction de la communauté est partagée : la V8 l'emporte sur la précision, mais comme l'a souligné Medium en avril 2026, "L'appareil photo est devenu plus précis, mais le photographe est parti." Savoir si la V8 est meilleure pour le travail artistique reste un débat ouvert parmi les utilisateurs de longue date.

Des prompts qui fonctionnent vraiment (avec leurs particularités)

Midjourney récompense le langage évocateur plutôt que la spécification. Décrire une ambiance ou un registre émotionnel donne généralement de meilleurs résultats qu'une liste d'équipement technique, l'outil interprétant mieux l'atmosphère qu'il ne suit les instructions.

Prompt 1 : L'environnement atmosphérique. "cinematic photo of an abandoned Tokyo arcade at 3am, neon reflections on wet pavement, 35mm film grain, --ar 16:9 --v 7". Ce que vous obtenez : de riches séparations de couleurs néon (cyan-magenta-ambre) plus saturées qu'une vraie pellicule, des reflets sur le bitume mouillé rendus avec une profondeur lumineuse, une superposition de grain qui semble plus impressionniste qu'authentique. Les détails des bornes sont génériques, aucun texte lisible, aucune précision de marque. Le registre émotionnel est précis ; la précision documentaire ne l'est pas. Quatre variations, chacune distincte dans sa composition, chacune saisissant parfaitement l'atmosphère. Si vous avez besoin que cela ressemble à une vraie photographie, utilisez FLUX. Si vous avez besoin que cela ressemble à un souvenir, c'est le prompt qu'il vous faut.

Prompt 2 : Le portrait éditorial avec personnalisation. "editorial portrait of a 60-year-old West African market trader, late afternoon golden light, shallow depth of field, analog warmth, --ar 4:5 --v 7 --p [personalization code]". Avec un profil de goûts orienté vers la chaleur documentaire, Midjourney ajoute des fondus dans les hautes lumières et approfondit les ombres dans la texture des tissus. La peau est rendue avec chaleur et dignité. Le bokeh est circulaire et crémeux, plus proche du magazine que du photojournalisme. Les mains apparaissent au repos ou partiellement masquées ; l'amélioration de 40 % de la précision des mains de la V7 laisse encore un taux d'échec élevé sur les poses exigeantes. Toute signalétique visible sera illisible. Ajoutez --cref pointant vers un portrait de référence pour la cohérence du visage ; sans cela, chaque variation produit un nouveau visage.

Les deux prompts illustrent le même principe : Midjourney interprète plutôt qu'il n'exécute. Si vous avez besoin d'un positionnement exact du sujet, d'un texte précis ou d'un contrôle strict de la composition, vous allez vous battre contre le modèle. Si vous voulez une image qui capture l'esprit de ce que vous avez décrit, et qui le dépasse souvent, c'est l'outil conçu pour cela.

Là où Midjourney a des difficultés : les mains, le texte, la cohérence

Le rendu du texte est l'échec technique le plus cité, un test exhaustif a enregistré un taux de réussite de 10 % pour un texte précis, ce qui signifie que 9 images sur 10 avec du texte dans le prompt produisent un résultat mal orthographié ou brouillé. FLUX et Adobe Firefly surpassent tous deux largement Midjourney sur ce point. La V8 Alpha a amélioré cela (approchant des taux de réussite de 50 %+ dans les premiers rapports), mais la V8 n'est pas encore sur le site principal. Si votre projet nécessite une signalétique lisible, des étiquettes de produits ou du texte d'interface utilisateur, Midjourney n'est pas le bon outil aujourd'hui.

Les mains restent incohérentes malgré l'amélioration documentée de 40 % de la V7 par rapport à la V6.1. Le propre style de sortie de Midjourney a tendance à éviter les poses de mains proéminentes pour cette raison exacte. La confidentialité est un problème structurel : chaque génération est publique à moins que le Stealth Mode ne soit activé, ce qui nécessite le forfait Pro à $60/mois. Les abonnés au forfait Standard ($30/mois) n'ont aucune option de génération privée, et un incident en 2024 au cours duquel un modérateur aurait accédé à une image en Stealth Mode a soulevé des questions sur les garanties d'accès interne, quel que soit le forfait. Privacy Watchdog a évalué les pratiques de Midjourney en matière de données à 38/100 (D+).

Les filtres de contenu génèrent des faux positifs sur le vocabulaire légitime de la mode, des beaux-arts et de la photographie. Les descriptions de tissus, les références aux tons de peau et le langage thématique sombre déclenchent des blocages tant au niveau du prompt que de la sortie, sans voie de recours rapide.

"Vous obtenez 4 images par prompt et vous savez, au moment où vous cliquez sur envoyer, qu'au moins l'une d'entre elles sera absolument inutilisable.". Avis Trustpilot (illustrateur de livres), cité dans la critique de Midjourney par computertech.co, février 2026

Utilisation commerciale : licences, droits d'auteur et filtres de sécurité

Tous les abonnés payants bénéficient de droits d'utilisation commerciale. Une exception : les entreprises dont le chiffre d'affaires annuel brut dépasse $1M USD doivent souscrire aux forfaits Pro ou Mega. Ces droits couvrent l'utilisation du résultat par l'abonné, ils ne résolvent pas les questions relatives aux données d'entraînement qui sont actuellement devant les tribunaux.

En juin 2025, Disney, Universal et DreamWorks ont intenté une action en justice contre Midjourney dans le district central de Californie, la première action majeure d'un studio hollywoodien contre un générateur d'images IA, alléguant une violation au niveau de l'entraînement et des résultats de personnages tels que Dark Vador, Shrek et Homer Simpson. L'affaire est en cours en avril 2026. Parallèlement, le recours collectif Andersen v. Stability AI / Midjourney a survécu à une décision d'août 2024 avec des réclamations directes pour violation du droit d'auteur intactes et est entré dans la phase de communication des pièces fin 2025. L'octroi de droits de Midjourney couvre l'utilisation en aval ; il ne résout pas les questions sur ce sur quoi le modèle a été entraîné.

Workflows de la communauté issus de Reddit et Discord

La bible de style de marque --sref est le workflow communautaire le plus innovant de Midjourney. Les directeurs artistiques construisent des systèmes d'identité visuelle internes sous forme de collections de codes de référence de style numériques, pas d'entraînement LoRA, pas d'images téléchargées, juste une séquence documentée de codes vérifiés par la communauté qui produisent de manière fiable des images fidèles à la marque. Lancez une session en itérant des combinaisons de codes jusqu'à ce que vous trouviez une pile correspondant à la voix de votre marque, documentez-la, partagez-la comme une recette de prompt avec toute l'équipe. Des sites comme srefhunt.com et midlibrary.io hébergent des bibliothèques consultables de codes vérifiés. Le résultat est une cohérence de marque à grande échelle sur un forfait à $30/mois sans aucune infrastructure d'entraînement IA.

"Dès l'instant où j'ai commencé à vendre des images Midjourney sur des places de marché de design, le forfait Standard s'est rentabilisé dès la première semaine.". Utilisateur Reddit sur r/midjourney, cité dans aitooldiscovery.com, 2025

Les développeurs de jeux et les studios d'animation utilisent un deuxième workflow documenté : générer 40 à 60 variations d'environnement en Draft Mode (moitié du coût GPU) avec un client ou un directeur artistique, sélectionner des directions, puis s'engager sur des rendus de qualité maximale. Les délais de la phase de concept passent de plusieurs semaines à quelques jours. La V7 excelle dans les environnements et les atmosphères, les temples dans la jungle, les horizons dystopiques, les terrains extraterrestres, où les indices de profondeur et l'éclairage dramatique communiquent immédiatement la direction.

"Je dépensais $200/mois en photos de banque d'images. Maintenant, je dépense $30 sur Midjourney et j'obtiens exactement l'ambiance dont j'ai besoin.". Créateur de contenu, cité dans la critique de Midjourney par aitoolanalysis.com, 2025

Midjourney vs. FLUX vs. Adobe Firefly

FLUX (par Black Forest Labs, accessible via Replicate, fal.ai, ou auto-hébergé sur ComfyUI) est le leader actuel de référence pour le photoréalisme, la précision anatomique et le rendu de texte. Lors d'un test à l'aveugle mené auprès de 12 designers, FLUX a remporté les évaluations de portraits photoréalistes ; Midjourney a remporté les scènes fantastiques cinématographiques 64 à 36. La différence fondamentale : FLUX suit les prompts à la lettre, positionnement précis, texte exact, contrôle strict de la composition. Midjourney interprète les prompts de manière expressive, ajoutant une profondeur cinématographique et une texture atmosphérique que le prompt n'avait pas demandées. Choisissez FLUX quand vous avez besoin d'exactitude ; choisissez Midjourney quand vous voulez de l'évocation. FLUX est un modèle sans plateforme native, sans flux communautaire, sans vidéo, sans Mood Boards, ni personnalisation, une capacité de génération brute, pas un environnement créatif.

Adobe Firefly est l'option commercialement sûre par conception, entraînée exclusivement sur des éléments sous licence Adobe Stock et du domaine public, de sorte que les résultats ne comportent aucun risque lié aux droits d'auteur. Il s'intègre nativement dans Photoshop, Lightroom et Premiere (Remplissage génératif, Développement génératif), ce qui signifie que l'étape de génération vit à l'intérieur de l'outil de production. La qualité d'image est compétente mais manque de la distinction esthétique de Midjourney, les résultats ont tendance à être neutres et documentaires plutôt que stylisés. Le filtre de contenu est moins agressif sur les prompts créatifs légitimes. Choisissez Firefly lorsque la provenance de la propriété intellectuelle compte plus que l'impact esthétique ; choisissez Midjourney lorsque l'image doit ressembler à de l'art. De nombreuses équipes utilisent les deux.

L'économie des crédits, ce que coûte un vrai projet

Midjourney facture au temps GPU, et non par image. Le forfait Basic ($10/mois) offre 3,3 heures de GPU Fast, soit environ 200 images, sans solution de repli en Relax Mode et sans Stealth Mode. C'est un arrêt brutal lorsque les heures sont épuisées. Le forfait Standard ($30/mois) ajoute 15 heures Fast plus un Relax Mode illimité (mis en file d'attente, plus lent, mais sans limite de volume), ce qui est là où se déroule la majeure partie du travail créatif soutenu. Le forfait Pro ($60/mois) ajoute 30 heures Fast, 12 tâches simultanées et le Stealth Mode, la fonction de confidentialité étant souvent la véritable raison pour laquelle les professionnels paient les $60. Le forfait Mega ($120/mois) double les heures Fast à 60.

Les multiplicateurs de coût GPU sont importants pour la planification : l'Omni Reference coûte 2x une tâche standard, le Turbo Mode coûte 2x, la V1 Video (quatre clips de 5 secondes en 480p, lancée en juin 2025) coûte environ 8x, et le Draft Mode coûte 0,5x. Les heures Fast non utilisées ne sont pas reportées.

"Le forfait Basic est essentiellement un essai payant. Vous atteignez la limite GPU au bout de 5 jours si vous l'utilisez sérieusement.". Utilisateur Reddit sur r/midjourney, cité dans aitooldiscovery.com, 2025

Le forfait Standard à $30/mois est le véritable point d'entrée. Le Relax illimité signifie que les lots en file d'attente pendant la nuit sont viables, lancez 200 variations pendant que vous dormez, passez-les en revue le matin. Pour le travail client confidentiel, le passage au forfait Pro pour le Stealth Mode est effectivement obligatoire, quels que soient les besoins en volume.

Avis des utilisateurs

Aucun avis pour l'instant. Soyez le premier à partager votre expérience !

Se connecter pour écrire un avis.

Comment Midjourney se compare

Comparatifs détaillés face à d'autres outils.

Présent dans les collections

Listes sélectionnées incluant Midjourney.

Articles associés

Guides et articles en lien avec Midjourney.