Midjourney V7 est sorti en test il y a quelques mois. Le 17 juin 2025, il est devenu le modèle par défaut pour tout le monde. Fini le choix, V6.1 passe en second rang. Trois nouveautés font tourner les têtes : l’omni-reference pour la cohérence de personnages, le Draft Mode pour itérer sans vider tes crédits, et la génération par voix sur mobile. Voyons ce que ça vaut vraiment pour quelqu’un qui produit des images régulièrement. Ce que tu vas apprendre :

  • Ce que le passage en modèle par défaut implique concrètement pour tes anciens prompts
  • Comment l’omni-reference (--oref) résout le problème de cohérence de personnage
  • Quand utiliser le Draft Mode et quand ne pas s’en fier
  • Si les prompts vocaux sont utiles ou juste un gadget
  • Pour qui V7 fait une vraie différence, et pour qui ça change moins que prévu

Midjourney V7 devient le modèle par défaut

Le 17 juin 2025, Midjourney a basculé V7 comme modèle actif pour tous ses abonnés. Ce n’est pas une mise à jour optionnelle : si tu tapes /imagine aujourd’hui sans préciser --v 6.1, tu génères en V7. Ce changement a des conséquences directes. V7 modifie la façon dont le modèle interprète les prompts : la fidélité aux instructions textuelles est plus serrée, le rendu par défaut a changé. Des prompts qui fonctionnaient bien en V6.1 peuvent donner des résultats différents, parfois meilleurs, parfois décevants selon ce que tu cherchais. Si tu as des prompts en production pour un client ou un projet en cours, c’est le bon moment de les retester avant de découvrir une surprise au mauvais moment.

Maquette de l'interface web Midjourney avec champ de prompt actif et modèle V7 sélectionné par défaut dans les paramètres.
Interface Midjourney : le champ « Imagine » est ouvert, avec le panneau de réglages ouvert dessous où le sélecteur de modèle affiche V7 comme option par défaut.

Omni-reference : verrouiller l’apparence d’un personnage

C’est la fonctionnalité la plus attendue depuis des années. L’omni-reference (--oref) permet de donner une image de référence à Midjourney pour qu’il maintienne l’apparence d’un personnage ou d’un objet d’une génération à l’autre. Avant ça, générer un personnage cohérent à travers plusieurs scènes était un combat. Tu pouvais utiliser le style reference (--sref) pour l’ambiance visuelle, mais l’apparence du personnage dérivait à chaque nouvelle image. Avec --oref, tu fournis une image source, et le modèle s’y accroche. La syntaxe est simple : /imagine [ton prompt] --oref [URL de ton image de référence]. Tu peux aussi ajuster l’intensité de la référence avec un paramètre de poids, ce qui te donne un contrôle sur à quel point le modèle colle à l’original versus laisse de la place à ton nouveau prompt.

Schéma : un portrait source à gauche est relié par trois flèches à trois vignettes de scènes différentes (montagne, ruelle, forêt) partageant le même visage.
Omni-reference (--oref) : une image source de personnage à gauche, propagée dans trois compositions distinctes tout en gardant les traits reconnaissables.

En pratique, les résultats ne sont pas parfaits. Le modèle maintient bien les traits distinctifs : couleur de cheveux, morphologie générale, éléments visuels forts. Les expressions fines et les angles inhabituels restent des zones de friction. Mais comparé à ce qu’on avait avant, c’est un saut qualitatif majeur pour quiconque fait de la narration visuelle, des BD, des pitchs de personnages ou du contenu de marque avec un visage récurrent.

Si tu fais du storytelling visuel ou du contenu de marque avec un personnage récurrent, l’omni-reference est probablement la raison principale de passer à V7. Ce seul ajout change le flux de travail.


Draft Mode : générer plus vite, dépenser moins de GPU

Le Draft Mode existe pour une situation précise : tu veux explorer des directions visuelles sans brûler tous tes crédits sur du rendu final. En mode brouillon, Midjourney génère des images environ 10 fois plus vite qu’en mode standard, avec une consommation de crédits GPU proportionnellement réduite. La qualité est inférieure : moins de détails, rendu plus grossier. Mais pour juger si une composition fonctionne, si une palette de couleurs est dans la bonne direction, ou si un concept mérite d’être poussé, c’est amplement suffisant.

Le flux de travail naturel devient : draft rapide pour choisir la direction → rendu complet sur la version retenue. Si tu génères beaucoup d’images par session (pour un moodboard client, de la recherche de concept, ou des variations d’un visuel publicitaire), tu peux allonger considérablement ton budget de crédits mensuel sans débourser plus.

Maquette de l'interface web Midjourney montrant côte à côte un rendu Draft Mode grossier et un rendu standard détaillé de la même scène.
Interface Midjourney V7 : à gauche, le Draft Mode génère une esquisse rapide et peu coûteuse ; à droite, le rendu standard affine la même composition avec les détails, les nuances et la texture attendues.

Le hic : le Draft Mode n’est pas fait pour le livrable final. Des clients ont partagé des brouillons par erreur en pensant présenter du rendu définitif. Établis la distinction clairement dans ton flux de travail avant de partager quoi que ce soit.

Prompts vocaux : dicter une image au lieu de la taper

Fonctionnalité Disponibilité Cas d'usage principal
Omni-reference (--oref) Web + Discord Cohérence personnage/objet multi-scènes
Draft Mode Web + Discord + Mobile Itération rapide, économie de crédits
Prompts vocaux Application mobile uniquement Saisie mains libres, idéation rapide

La génération par commande vocale est disponible via l’application mobile Midjourney. Tu dictes ton prompt, l’app le transcrit et lance la génération. Pas besoin de taper sur un petit clavier de téléphone. C’est utile dans des contextes spécifiques : tu es en déplacement, tu veux capturer une idée rapidement, ou tu travailles en brainstorming où la fluidité de la pensée compte plus que la précision du prompt. La transcription fonctionne en anglais, et les prompts complexes avec des paramètres techniques (--ar, --oref, --style) restent plus pratiques à taper qu’à dicter.

Soyons honnêtes : c’est une fonctionnalité de commodité, pas une révolution. Si ton flux de travail se passe principalement sur ordinateur, tu ne vas pas changer d’habitude pour ça. Mais sur mobile, ça retire une friction réelle quand tu veux tester une idée vite.

Ce que V7 change concrètement dans ton flux de travail

V7 est plus littéral dans son interprétation des prompts. En V6.1, le modèle avait tendance à interpréter et à « embellir » ta demande selon son propre sens esthétique. V7 colle davantage à ce que tu demandes, ce qui est une bonne nouvelle si tu as des descriptions précises, et une mauvaise nouvelle si tu comptes sur le modèle pour « trouver quelque chose de beau » à partir d’un prompt vague.

V7 récompense les prompts précis. Si tu travaillais avec des prompts courts et flous en V6.1 parce que ça donnait des résultats intéressants, tu vas devoir ajuster ton approche. La personnalisation continue de fonctionner via le système de notation d’images. Pour calibrer le modèle à tes préférences esthétiques personnelles, il faut noter un volume significatif d’images : les données internes de Midjourney indiquent qu’environ 200 images notées sont nécessaires pour que la personnalisation soit réellement efficace. C’est un investissement de temps, mais si tu utilises Midjourney de façon intensive, ça vaut la peine.

Diagramme en quatre étapes du flux de travail Midjourney V7 : Draft Mode, sélection, omni-reference puis rendu final.
Le flux recommandé sur V7 : explorer large en Draft Mode (crédits économisés), verrouiller une direction, appliquer <code>--oref</code> pour la cohérence de personnage, puis basculer en mode standard pour le rendu final.

Les plans restent les mêmes. Le plan Basic à 10 $US/mois (ou 8 $US/mois en facturation annuelle) couvre un usage occasionnel. Le Standard à 30 $US/mois (ou 24 $US/mois en facturation annuelle) est le bon point d’entrée pour un usage régulier. Le Pro à 60 $US/mois (ou 48 $US/mois en facturation annuelle) ajoute le mode furtif (images privées) et plus de GPU. Le Mega à 120 $US/mois (ou 96 $US/mois en facturation annuelle) est pour les workflows industriels.


Limites et points à surveiller

L’omni-reference est puissante mais imparfaite. La cohérence se maintient mieux sur des personnages avec des traits distinctifs forts que sur des visages génériques. Sur des angles très inhabituels (vue de dos, contre-plongée extrême), la fidélité à la référence peut dériver. Il faut parfois plusieurs tentatives pour trouver le bon poids de référence.

Maquette d'interface Midjourney illustrant une génération avec omni-reference : prompt contenant les paramètres --oref et --ow, image de référence d'un personnage et deux nouvelles scènes générées reprenant ce personnage.
Interface schématisée de Midjourney V7 : le paramètre --oref pointe vers une image de référence et --ow règle le poids d'influence. Le personnage de gauche est réinjecté cohéremment dans deux scènes générées à droite.

Le Draft Mode a une limite évidente : la qualité brouillon n’est pas présentable. Des utilisateurs ont signalé de la confusion quand ils partagent des grilles de Draft Mode à des collaborateurs non-initiés. Ce n’est pas un bug, c’est une question de communication interne. La fidélité accrue de V7 aux prompts a aussi un revers : les prompts qui comptaient sur la « créativité spontanée » du modèle donnent des résultats plus plats. V7 fait exactement ce que tu lui demandes. Si tu ne sais pas exactement ce que tu veux, V6.1 était plus indulgent. Pour les prompts vocaux, la transcription fait des erreurs sur les termes techniques, les noms propres, et les descriptions complexes. Un prompt avec des références stylistiques précises est généralement plus sûr à taper.

Un point pratique : si tu as des templates de prompts sauvegardés pour un usage régulier, teste-les en V7 avant de les utiliser en production. La transition automatique du 17 juin 2025 n’a pas prévenu tout le monde.


Verdict : pour qui V7 fait une vraie différence

V7 est le bon choix si tu fais de la narration visuelle ou du contenu avec des personnages récurrents. L’omni-reference seule justifie la mise à niveau pour ce cas d’usage. Le problème de cohérence de personnage était l’un des plus grands irritants de Midjourney depuis le début. Le Draft Mode fait une différence réelle pour quiconque génère beaucoup d’images par session. Explorer des directions à 10x la vitesse sans consommer autant de crédits, c’est du temps et de l’argent épargnés sur le long terme. Si tu utilises Midjourney pour du rendu final occasionnel avec des prompts courts et vagues, tu verras moins de bénéfice immédiat. V7 demande plus de précision pour donner le meilleur de lui-même.

Profil V7 fait une différence majeure V7 apporte peu
Créateur de personnages / storyboard ✅ Omni-reference change le jeu ,
Moodboard / exploration concept ✅ Draft Mode économise les crédits ,
Rendu final qualité max ✅ Meilleure fidélité au prompt ,
Prompts vagues, usage casual , V6.1 était plus indulgent
Workflow entièrement sur ordinateur , Les prompts vocaux n'ajoutent rien

Les prompts vocaux restent anecdotiques pour un usage pro. Utiles sur mobile, pas transformateurs. La vraie question n’est pas « est-ce que V7 est meilleur que V6.1? » La réponse est oui sur presque tous les axes techniques. La vraie question est : est-ce que ton flux de travail est prêt à fonctionner avec un modèle qui colle davantage à tes instructions précises? Si oui : vas-y. Reteste tes prompts clés, active l’omni-reference sur ton prochain projet de personnage, et utilise le Draft Mode pour tes sessions d’exploration. Fin de l’histoire.

[TOOL_SPOTLIGHT: name=“Midjourney V7” description=“Génération d’images par IA avec omni-reference pour la cohérence de personnages, Draft Mode pour l’itération rapide, et prompts vocaux sur mobile.” url=“https://www.midjourney.com” badge=“Mis à jour” ]

On continue à la Taverne ?

Un courriel par semaine. Pas de fluff.

En t'abonnant, tu reçois Le Tour de Table chaque semaine. Tu peux te désabonner en un clic. Voir notre politique de confidentialité.

Texte par David Cyr