Midjourney vient de franchir une étape que beaucoup attendaient : la génération vidéo à partir de texte est maintenant dans le menu. Pour un outil qui a bâti sa réputation sur des images fixes d’une cohérence visuelle remarquable, c’est un virage majeur. Le marché de la vidéo IA est déjà chargé. Sora, Runway Gen-3, Kling : des joueurs établis avec des mois d’avance. Midjourney débarque en retardataire assumé, mais avec un atout que personne d’autre n’a : des millions d’utilisateurs déjà habitués à son système de prompt. Ce que tu vas apprendre :

  • Ce que Midjourney a annoncé exactement et comment la fonctionnalité fonctionne
  • Les forces réelles et les limites honnêtes des résultats actuels
  • Comment Midjourney vidéo se positionne face à Sora, Runway Gen-3 et Kling
  • Qui peut y accéder et à quel prix selon ton plan actuel
  • Ce que ça change concrètement dans ton workflow

Ce que Midjourney annonce exactement

Midjourney a confirmé le lancement de sa fonctionnalité de génération vidéo à partir de texte. L’annonce positionne clairement cet ajout comme une extension naturelle de l’outil existant : même interface, même logique de prompt, mais en mouvement. Ce n’est pas une application séparée ni un produit distinct. C’est intégré directement dans la plateforme Midjourney, ce qui veut dire que si tu utilises déjà l’outil, tu n’as pas de nouvelle courbe d’apprentissage à absorber. Tu tapes un prompt, tu ajustes quelques paramètres spécifiques à la vidéo, et tu génères.

Maquette au trait de l'interface Midjourney avec champ de prompt actif et panneau latéral d'options vidéo (durée, motion, ratio, loop).
Aperçu schématique de l'interface de génération vidéo Midjourney : à gauche, le champ de prompt hérité du workflow image ; à droite, un panneau de paramètres vidéo (durée, intensité de mouvement, ratio, boucle) — les valeurs affichées sont indicatives.

La logique d’intégration est intelligente. Midjourney n’essaie pas de repartir de zéro. L’entreprise capitalise sur ce qu’elle fait déjà mieux que la plupart : la direction artistique, la cohérence stylistique, le contrôle sur l’esthétique visuelle. La vidéo hérite de ces forces.

Ce que ça signifie concrètement : tu peux réutiliser des prompts que tu as développés pour tes images fixes et les pousser directement en vidéo. Ton vocabulaire Midjourney existant reste valide.


Comment fonctionne la génération vidéo dans Midjourney

La mécanique de base reste celle que les utilisateurs Midjourney connaissent déjà : tu écris un prompt textuel descriptif, tu ajoutes des paramètres pour guider le résultat. La différence, c’est que des paramètres propres au mouvement et à la durée s’ajoutent à l’équation. Tu peux contrôler l’intensité du mouvement dans la scène. Un mouvement minimal donne quelque chose qui ressemble à une image légèrement animée, presque un cinemagraph. Un mouvement plus élevé génère une scène avec des déplacements de caméra ou d’éléments plus prononcés. Le contrôle reste granulaire, du moins dans la direction que l’outil indique.

Schéma éditorial en trois étapes : prompt textuel, image fixe intermédiaire, puis séquence vidéo, avec quatre branches de paramètres annotées (style, composition, intensité du mouvement, durée).
Le pipeline de Midjourney vidéo : le texte engendre d'abord une image fixe, qui sert de point de départ à une courte séquence animée. À chaque étape, des paramètres viennent moduler le résultat — style et ambiance en amont, cadrage au milieu, intensité du mouvement et durée en sortie.

Ce qui est intéressant : Midjourney permet aussi de partir d’une image fixe existante pour générer une vidéo. Tu prends une image que tu as déjà créée (ou une image externe), et tu demandes à l’outil de l’animer. C’est une approche hybride qui donne plus de contrôle sur le point de départ visuel, ce qui est souvent le nœud du problème dans la génération vidéo IA. La durée des clips générés est limitée pour l’instant. Les vidéos produites sont courtes : quelques secondes par génération. Ce n’est pas surprenant pour un premier lancement, et c’est cohérent avec ce que les autres outils proposaient à leurs débuts. L’outil n’est pas prêt pour des séquences longues ou des productions continues.

Maquette au trait d'une interface Midjourney affichant une grille de quatre clips vidéo générés, chacun avec une barre de lecture et un indicateur de durée.
Grille de résultats : quatre variations vidéo côte à côte, chacune avec sa barre de progression et sa durée — le même paradigme que la grille d'images, transposé au mouvement.

Qualité et limites : ce qu’on peut attendre pour l’instant

La cohérence visuelle est clairement la force de Midjourney vidéo. Le style esthétique reste stable d’une frame à l’autre, ce qui est un problème chronique dans la vidéo IA en général. Beaucoup d’outils produisent des vidéos où les visages changent subtilement, où les textures fluctuent, où la lumière dérive de façon non naturelle entre les secondes. Midjourney semble mieux gérer cette cohérence, probablement parce que son modèle sous-jacent est entraîné depuis des années sur la stabilité stylistique. Le contrôle du mouvement, par contre, reste partiel. Tu peux indiquer une intention de mouvement, mais les résultats ne sont pas toujours prévisibles. Un mouvement de caméra demandé peut se retrouver légèrement décalé, ou un élément en mouvement dans la scène peut se comporter de façon inattendue. C’est une limite commune à la génération vidéo IA en ce moment, pas un problème spécifique à Midjourney.

L’honnêteté s’impose ici : Midjourney vidéo en est à ses premiers kilomètres. Les résultats sont prometteurs sur le plan stylistique, mais l’outil n’est pas encore à la maturité de ce qu’il fait avec les images fixes. C’est normal. C’est la version de lancement. Les mouvements complexes sont plus difficiles à gérer que les mouvements simples. Une caméra qui tourne lentement autour d’un objet : correct. Une scène avec plusieurs personnages en interaction physique : beaucoup plus aléatoire. La physique reste le talon d’Achille de toute la catégorie.

Un autre point à noter : la résolution des vidéos générées et le débit image sont à vérifier selon ton plan actuel. Ce type de paramètre technique varie selon l’abonnement et peut évoluer rapidement avec les mises à jour.

Midjourney vidéo face à Sora, Runway Gen-3 et Kling

C’est ici que les choses deviennent intéressantes. Midjourney entre dans un marché où plusieurs outils sont déjà établis, chacun avec ses forces propres. Sora (OpenAI) est l’outil qui a provoqué le plus de bruit lors de son annonce. Sa force principale est la compréhension du mouvement physique et des interactions complexes dans une scène. Les vidéos générées sont souvent longues et fluides, avec une cohérence temporelle impressionnante. La faiblesse : l’accès reste limité selon les plans OpenAI, et le contrôle stylistique fin est moins développé que chez Midjourney. Runway Gen-3 est l’outil le plus utilisé en production professionnelle. Il offre des fonctionnalités d’édition vidéo plus avancées, une intégration dans des workflows existants, et une qualité de mouvement de caméra supérieure à la moyenne. C’est l’outil que les studios et les agences utilisent déjà. Son désavantage : la courbe d’apprentissage est plus technique, et son modèle de prix est construit différemment. Kling (développé en Chine par Kuaishou) a surpris tout le monde lors de son arrivée. Sa gestion des mouvements humains est particulièrement forte : les corps se déplacent de façon plus naturelle, les expressions faciales sont plus stables. Il s’est positionné rapidement comme une alternative sérieuse pour les contenus centrés sur des personnages.

Outil Force principale Faiblesse principale Accès actuel
Midjourney vidéo Cohérence stylistique et esthétique Contrôle du mouvement partiel Abonnés Midjourney existants
Sora (OpenAI) Compréhension physique et fluidité Accès restreint, contrôle stylistique limité Plans OpenAI sélectionnés
Runway Gen-3 Workflow professionnel, mouvement de caméra Courbe d'apprentissage technique Abonnement Runway
Kling Mouvement humain naturel Moins connu en Occident, documentation FR limitée Accès web, app mobile

Là où Midjourney a un avantage structurel sur tous ces outils : sa base d’utilisateurs existante. Des millions de personnes savent déjà prompter en Midjourney. Elles connaissent les paramètres, le vocabulaire, les techniques de prompt pour obtenir un style précis. Passer à la vidéo dans le même environnement a une friction quasi nulle.

Diagramme de positionnement à deux axes plaçant Midjourney, Sora, Runway et Kling selon leur contrôle stylistique et leur contrôle du mouvement.
Chaque outil occupe un quadrant selon ses forces relatives : Midjourney domine la signature stylistique mais reste prudent sur le mouvement ; Sora pousse la cohérence narrative ; Runway offre le pilotage technique le plus fin ; Kling mise sur un réalisme physique rapide.

Runway et Kling demandent un apprentissage séparé. Sora aussi. Midjourney vidéo, tu le maîtrises partiellement le jour un, si tu es déjà dans l’écosystème.

Prix et disponibilité

Les abonnements Midjourney restent les mêmes. La génération vidéo est intégrée dans les plans existants, pas un add-on séparé à payer en plus. Voici les plans actuels :

  • Basic : 10 $US/mois (8 $US/mois en facturation annuelle)
  • Standard : 30 $US/mois (24 $US/mois en facturation annuelle)
  • Pro : 60 $US/mois (48 $US/mois en facturation annuelle)
  • Mega : 120 $US/mois (96 $US/mois en facturation annuelle)

Important : les limites d’accès à la génération vidéo selon le niveau de plan ne sont pas encore entièrement documentées publiquement au moment d’écrire cet article. Il est probable que les plans supérieurs donnent accès à des résolutions plus élevées, des durées de clips plus longues, ou un volume de générations vidéo plus important. À vérifier dans la documentation officielle Midjourney pour ton plan spécifique.

Maquette au trait de la page de tarification Midjourney avec quatre offres et une ligne vidéo mise en évidence.
Quatre paliers d'abonnement côte à côte : la ligne « video gen » apparaît dès l'offre intermédiaire et monte en résolution vers le haut de gamme.

Ce qui est clair : si tu as déjà un abonnement actif, tu n’as pas de frais supplémentaires à anticiper pour tester la fonctionnalité de base. C’est un avantage concret par rapport à des outils comme Runway, qui fonctionnent sur un modèle de crédits séparé. L’accès s’est déployé graduellement, avec les abonnés des plans supérieurs en priorité. Si tu ne vois pas encore l’option dans ton interface, vérifie la documentation officielle ou le Discord Midjourney pour l’état du déploiement sur ton plan.

Ce que ça change concrètement pour les utilisateurs

Pour les créateurs de contenu qui utilisent déjà Midjourney pour leurs visuels, c’est une extension directe de leur workflow. Au lieu de générer une image fixe pour un post ou une présentation, tu peux générer une courte séquence animée. Même prompt, résultat qui capte l’attention autrement. Pour les équipes qui travaillent sur des pitchs, des présentations clients, ou des concepts créatifs, la génération vidéo ouvre des possibilités de prototypage rapide. Tu peux montrer un concept en mouvement sans passer par un outil de motion design séparé.

Maquette au trait d'une interface de chat Midjourney montrant un prompt vidéo détaillé avec paramètres et un rendu vidéo en cours de génération.
Interface fictive de Midjourney en mode vidéo : le prompt intègre des paramètres de mouvement, durée et fréquence d'images, tandis que le fil affiche l'aperçu du rendu en cours et les options de variation.

Sauf que la vraie affaire, c’est ce que ça change pour les utilisateurs qui hésitaient entre Midjourney et un outil vidéo dédié. Avant ce lancement, si tu voulais intégrer de la vidéo IA dans ton workflow, tu devais apprendre un deuxième outil, gérer un deuxième abonnement, naviguer une deuxième interface. Maintenant, tu as une option dans un environnement que tu connais déjà. Le hic, c’est que ça reste une option de premier accès. Si tu as besoin de vidéos avec des mouvements complexes, une durée substantielle, ou un niveau de contrôle cinématographique précis, Runway Gen-3 ou Kling restent probablement plus adaptés à ce stade. Midjourney vidéo est une excellente porte d’entrée, pas encore l’outil de production avancée que les professionnels de la vidéo cherchent. Pour les indépendants et les petites équipes qui veulent ajouter du mouvement à leur production visuelle sans changer d’écosystème : c’est exactement ce qu’il leur faut. Pour les studios qui vivent de la production vidéo IA : la conversation avec Runway et Kling reste d’actualité.

Diagramme comparant deux parcours utilisateurs vers la vidéo Midjourney : un chemin court pour les utilisateurs existants et un chemin plus long pour les nouveaux venus.
Deux parcours, une même sortie. À gauche, l'utilisateur Midjourney existant hérite d'un raccourci : compte, style et prompt sont déjà maîtrisés, la vidéo n'est qu'un clic supplémentaire sur une image validée. À droite, le nouveau venu doit franchir chaque marche — comparer les outils, apprivoiser Discord, apprendre la grammaire spécifique du prompt MJ — avant même son premier rendu. La friction cumulée explique pourquoi Midjourney arrive tard sans arriver perdant : son avantage n'est pas technique, il est distributif.

Verdict : un entrant sérieux, pas encore un champion toutes catégories

Midjourney vidéo est une bonne nouvelle pour les utilisateurs existants de la plateforme. La cohérence stylistique est réelle, l’intégration est fluide, et le modèle de prix est honnête. Tu ne paies pas en plus pour une fonctionnalité de base. Mais soyons clairs : c’est une version de lancement. Le contrôle du mouvement est encore en développement, les clips sont courts, et les cas d’usage complexes restent mieux servis par des outils spécialisés. Midjourney construit quelque chose, et ce premier pas est solide, mais Runway et Kling ont une avance réelle sur la maturité de leur moteur vidéo. Si tu es déjà abonné Midjourney : teste maintenant. La friction est nulle et tu vas apprendre vite ce que l’outil peut faire pour toi spécifiquement. Si tu cherches un outil vidéo IA sans historique Midjourney : compare les options avant de choisir ton point d’entrée. Le marché de la vidéo IA vient de devenir encore plus intéressant. C’est tout.


Tu veux suivre l’évolution de la vidéo IA semaine après semaine? Le Tour de Table couvre les mises à jour des outils qui comptent. Abonnement dans le pied de page.

On continue à la Taverne ?

Un courriel par semaine. Pas de fluff.

En t'abonnant, tu reçois Le Tour de Table chaque semaine. Tu peux te désabonner en un clic. Voir notre politique de confidentialité.

Texte par David Cyr