Culture et médias

Midjourney V7 accélère l’esquisse et affine la compréhension des prompts

Midjourney ouvre l’alpha de V7, son nouveau modèle de génération d’images. La mise à jour promet une lecture plus fine des instructions, une personnalisation des résultats et un mode Ébauche dix fois plus rapide, pensé pour multiplier les essais créatifs sans alourdir la facture.

Une créatrice utilise la voix pour tester rapidement plusieurs images générées par IA sur son écran.
Illustration : Actu.ai

Midjourney ne cherche pas seulement à produire des images plus spectaculaires : avec V7, le service veut aussi rendre le processus de création plus fluide. Lancée en alpha au début d’avril 2025, cette nouvelle version du modèle de génération d’images met l’accent sur trois leviers très concrets : mieux comprendre les consignes écrites, tenir compte des préférences visuelles de l’utilisateur et accélérer la phase d’exploration grâce à un nouveau mode Ébauche.

Pour les illustrateurs, designers, communicants ou simples curieux, la promesse est importante. Une image générée par IA s’obtient rarement du premier coup : il faut essayer une formulation, modifier un sujet, changer un cadrage, puis recommencer. En réduisant le temps et le coût de ces essais, Midjourney V7 entend rapprocher la génération d’images d’un échange créatif continu plutôt que d’une succession de commandes isolées.

V7, un nouveau modèle encore en phase alpha

Midjourney a mis V7 à la disposition de sa communauté sous la forme d’une alpha. Cette étape signifie que le modèle est accessible pour être testé, mais qu’il reste en évolution rapide. L’entreprise invite donc les utilisateurs à expérimenter, à identifier ses forces comme ses limites et à lui transmettre leurs retours.

Le progrès central annoncé concerne l’interprétation des prompts. Un prompt est la description textuelle qui guide l’image, par exemple le sujet, la composition, les matériaux, l’éclairage ou l’ambiance souhaitée. Pour un générateur d’images, comprendre un prompt ne revient pas seulement à reconnaître une liste de mots. Le modèle doit aussi relier ces éléments entre eux : qui tient quel objet, quelle matière recouvre quelle surface, quelle posture adopte un personnage, ou encore quel détail doit rester identique d’une zone de l’image à l’autre.

Midjourney affirme que V7 améliore à la fois la compréhension de ces demandes, la qualité des rendus et la cohérence des caractéristiques visuelles. L’enjeu est particulièrement visible dans les éléments qui posent souvent problème aux modèles d’images : les corps, les mains et les objets. V7 promet également des textures plus détaillées et des images plus claires.

Cette amélioration ne veut pas dire que chaque instruction sera exécutée parfaitement, ni que les anciennes habitudes de rédaction fonctionneront forcément à l’identique. Midjourney décrit V7 comme un modèle distinct, avec ses propres comportements. Une consigne très efficace avec V6 peut donc nécessiter une reformulation ou plusieurs essais avec V7.

Une personnalisation activée par défaut pour mieux cerner les goûts

L’autre changement structurant de V7 est la place donnée à la personnalisation. Cette fonction est activée par défaut avec le nouveau modèle, mais l’utilisateur doit d’abord la débloquer. Midjourney indique que cette étape initiale demande environ cinq minutes.

L’objectif est d’ajuster l’interprétation du modèle aux préférences esthétiques propres à chacun. Deux personnes peuvent employer une demande très proche, comme « affiche minimaliste pour un café », tout en attendant des résultats très différents. L’une recherchera peut-être une image graphique très épurée, l’autre une composition plus illustrative ou plus riche en matière. La personnalisation vise à réduire cet écart entre une formulation générale et une attente visuelle personnelle.

Cette option peut être activée ou désactivée à tout moment. Cette souplesse est utile lorsque l’on veut, selon les projets, retrouver une sensibilité visuelle habituelle ou au contraire repartir d’une interprétation plus neutre. Pour Midjourney, cette fonction constitue une étape importante dans la compréhension de l’intention créative des utilisateurs.

Il faut toutefois distinguer personnalisation et contrôle absolu. La personnalisation peut orienter les résultats vers des préférences esthétiques, mais elle ne dispense pas de rédiger une demande claire. Les éléments importants, tels qu’un nombre de personnages, une action précise, la place d’un objet ou le format souhaité, gagnent toujours à être explicités dans le prompt.

Le mode Ébauche privilégie les essais rapides

La nouveauté la plus immédiatement perceptible est le mode Ébauche, appelé Draft Mode. Il est conçu pour accélérer les phases de recherche, quand le créateur veut comparer des idées avant de consacrer davantage de ressources à une version finale.

Selon Midjourney, ce mode génère des images dix fois plus rapidement et les facture à moitié prix. La contrepartie est assumée : l’image produite est de qualité inférieure à celle d’une génération complète. Elle conserve néanmoins les comportements et les caractéristiques esthétiques du modèle, ce qui en fait un aperçu utile pour juger une composition, une direction créative ou une idée de prompt.

Élément comparéMode ÉbaucheGénération en qualité complète
Vitesse annoncéeJusqu’à dix fois plus rapidePlus lente que l’ébauche
Coût annoncéMoitié du coût d’un travail standardCoût standard selon le mode choisi
Qualité d’imageInférieure, pensée pour l’itérationPlus élevée, destinée au rendu final
Usage principalTester et corriger rapidement une idéeProduire ou finaliser une image retenue
Suite possibleAméliorer ou varier l’image sélectionnéeCréer des déclinaisons à partir du résultat

Concrètement, ce mode sépare mieux deux moments qui étaient souvent confondus : chercher une idée et produire le fichier que l’on souhaite conserver. L’utilisateur peut d’abord générer plusieurs pistes à faible coût, retenir celle qui possède la meilleure composition, puis choisir de l’améliorer ou de la faire varier pour obtenir un résultat en pleine qualité.

Mode Ébauche ou génération complète : quel choix pour V7 ?

Mode Ébauche

  • Génère les images jusqu’à dix fois plus rapidement.
  • Coûte moitié moins qu’un travail standard.
  • Affiche une qualité réduite, suffisante pour tester une idée.
  • Convient aux essais de composition, de sujet et d’ambiance.
  • Une image retenue peut ensuite être améliorée ou variée.

Qualité complète

  • Vise un rendu final plus détaillé que l’ébauche.
  • Demande davantage de temps de génération.
  • Coûte davantage que le mode Ébauche.
  • S’utilise après avoir validé une direction créative.
  • Peut être privilégiée lorsque la précision visuelle compte immédiatement.

Un échange plus direct avec l’outil, par texte ou par la voix

La rapidité du mode Ébauche permet à Midjourney de proposer un usage plus conversationnel sur son interface web. Au lieu de repartir systématiquement d’un prompt entièrement réécrit, l’utilisateur peut demander une modification simple à partir d’une image ou d’une idée déjà générée. Midjourney donne l’exemple d’un changement de sujet : remplacer un chat par un hibou. Le système adapte alors automatiquement la demande et lance une nouvelle génération.

Ce fonctionnement vise à rendre les ajustements plus naturels. Dans une pratique créative classique, on ne reconçoit pas nécessairement toute une image lorsqu’un détail doit changer. On demande plutôt de conserver l’ensemble en modifiant un élément. Le mode conversationnel cherche à reproduire cette logique d’itération, avec une IA qui reformule la requête nécessaire à la nouvelle tâche.

Le mode Ébauche intègre aussi une fonction de saisie vocale. L’utilisateur peut exprimer son idée oralement, voir les propositions se générer en quasi temps réel, puis préciser sa demande. Cette approche peut être particulièrement pratique au stade du brouillon, lorsque le but est de tester rapidement des associations de sujets, de décors ou d’ambiances sans passer beaucoup de temps à peaufiner chaque formulation au clavier.

La voix ne transforme pas pour autant la création d’images en dialogue parfaitement fidèle à toutes les nuances humaines. Comme avec un prompt écrit, le résultat dépendra de la manière dont le système interprète les mots et de la capacité de l’utilisateur à évaluer puis à corriger l’image obtenue. Son intérêt est surtout de raccourcir le cycle : idée, aperçu, correction, nouvel aperçu.

Quels modes et outils sont disponibles avec V7 ?

Au moment du lancement alpha, Midjourney prévoit V7 dans deux modes de vitesse : Turbo et Détente. Le mode Turbo permet d’obtenir les résultats plus vite, mais il coûte deux fois le prix d’un travail standard. Midjourney indique que le mode standard doit être optimisé prochainement.

Les choix de vitesse et de qualité ne concernent donc pas seulement le confort : ils ont un effet direct sur la consommation de crédits ou de temps de calcul. Le mode Ébauche est conçu pour les itérations nombreuses, Turbo pour privilégier le délai, tandis que Détente constitue l’autre option proposée lors de cette première phase.

Toutes les fonctions associées à Midjourney ne basculent pas immédiatement sur V7. Au lancement, l’amélioration d’image, l’édition et le retexture utilisent d’abord le modèle V6. Cette précision compte pour les utilisateurs qui intègrent ces outils dans un flux de travail précis : employer V7 pour générer une image initiale ne signifie pas nécessairement que chaque étape de retouche suivante reposera sur le même modèle.

Les mood boards et les SREF sont, eux, déjà opérationnels. Les mood boards servent à travailler à partir d’orientations visuelles, tandis que SREF renvoie à la référence de style, une fonction qui aide à guider le rendu vers une direction esthétique donnée. Midjourney prévoit encore des améliorations sur ces fonctionnalités.

Comment tirer parti de V7 sans multiplier les générations inutiles ?

L’alpha de V7 encourage une méthode de travail progressive. La première étape consiste à débloquer la personnalisation, puis à vérifier, sur quelques demandes simples, si son interprétation correspond aux préférences recherchées. Comme l’option peut être désactivée, il est utile de comparer les résultats personnalisés et non personnalisés sur un même type de projet.

Le mode Ébauche peut ensuite servir à sonder rapidement plusieurs pistes. Plutôt que d’exiger immédiatement une image très détaillée, on peut se concentrer sur les variables qui déterminent le plus la scène : le sujet principal, la relation entre les éléments, le cadrage, l’ambiance générale et le degré de réalisme ou de stylisation. Une fois la composition convaincante, l’option d’amélioration permet de passer au rendu complet.

Quelques réflexes restent pertinents avec un nouveau modèle :

  • formuler clairement le sujet et l’action attendue ;
  • préciser les éléments qui doivent rester cohérents, notamment les personnages ou les objets ;
  • modifier une variable à la fois lors des essais, afin de comprendre l’effet de chaque changement ;
  • conserver les prompts qui donnent de bons résultats, tout en acceptant de les adapter à V7.

Cette démarche n’est pas seulement une question de coût. Elle permet aussi de mieux comprendre la logique du modèle. Midjourney prévient que différentes techniques de prompting peuvent être nécessaires par rapport aux versions précédentes. Les premiers utilisateurs ne testent donc pas un simple réglage supplémentaire : ils découvrent un nouvel équilibre entre formulation, personnalisation et vitesse de génération.

Ce qu’il faut surveiller dans les prochaines semaines

Midjourney annonce un rythme de développement soutenu pour V7, avec de nouvelles fonctions attendues toutes les une à deux semaines pendant 60 jours. Parmi les évolutions annoncées figure une capacité de référence pour les personnages et les objets. Cette fonction est particulièrement attendue pour les usages narratifs, publicitaires ou éditoriaux, où il est essentiel de conserver l’apparence d’un même protagoniste ou d’un même produit à travers plusieurs images.

La période alpha permettra surtout de mesurer si les promesses de compréhension et de cohérence se vérifient sur une grande variété de demandes. Les gains affichés par le mode Ébauche pourraient modifier les habitudes des utilisateurs en valorisant davantage l’expérimentation, mais la qualité finale, la fiabilité des détails et l’intégration des outils d’édition resteront déterminantes.

V7 illustre ainsi une évolution plus large des générateurs d’images : la compétition ne se joue plus seulement sur la capacité à fabriquer une belle image isolée. Elle porte aussi sur la vitesse des essais, la continuité du dialogue avec l’utilisateur et la capacité à traduire une intention visuelle personnelle en résultats exploitables.

Questions fréquentes

Quelles sont les nouveautés de Midjourney V7 ?

Midjourney V7 améliore la compréhension des prompts, la qualité des textures et la cohérence des éléments visuels, notamment les corps, les mains et les objets. L’alpha introduit aussi une personnalisation activée par défaut après déblocage, un mode Ébauche plus rapide et une interface web capable de traiter certaines demandes de modification de façon conversationnelle.

Le mode Ébauche de Midjourney V7 est-il vraiment moins cher ?

Oui. Midjourney annonce que le mode Ébauche génère les images dix fois plus vite et coûte moitié moins qu’un travail standard. En contrepartie, les aperçus sont de qualité inférieure. Le mode est donc surtout adapté aux tests rapides, avant d’améliorer ou de varier une image sélectionnée en qualité complète.

Comment fonctionne la personnalisation dans Midjourney V7 ?

La personnalisation de V7 vise à mieux tenir compte des préférences esthétiques de l’utilisateur lors de l’interprétation des prompts. Elle est activée par défaut, mais doit être débloquée lors d’une étape initiale d’environ cinq minutes. L’utilisateur peut ensuite l’activer ou la désactiver selon le projet et l’effet recherché.

Quelle est la différence entre les modes Turbo et Détente de Midjourney V7 ?

Au lancement de l’alpha, V7 est prévu avec les modes Turbo et Détente. Turbo privilégie la rapidité, mais une tâche dans ce mode coûte deux fois le prix d’un travail standard. Midjourney indique que le mode standard doit encore être optimisé. Le choix dépend donc principalement du compromis recherché entre délai et coût.

Les outils d’édition et d’upscaling utilisent-ils déjà Midjourney V7 ?

Pas entièrement. Au lancement, l’amélioration d’image, l’édition et le retexture reposent d’abord sur le modèle V6. Les mood boards et les SREF sont déjà disponibles, avec des améliorations attendues. Midjourney prévoit aussi d’ajouter une capacité de référence pour les personnages et les objets au cours des mises à jour suivantes.

Sources

Références consultées pour la rédaction de cet article. Les adresses sont indiquées à titre informatif et ne sont pas des liens.

  1. Midjourney, page officielle des mises à jour du produitwww.midjourney.com/updates
  2. Midjourney, documentation officielledocs.midjourney.com
  3. Midjourney, site officielwww.midjourney.com