Dans le domaine de la création d’images par l’intelligence artificielle, on sait à quel point l’établissement de données textuelles pertinentes a une influence décisive sur le résultat. C’est ce qui a motivé les différents essais ci-dessous, sous forme de « Benchmark ». Précisons qu’on peut travailler assis, sur PC ou Mac mais aussi effondré sur un canapé voire au lit car toutes les applications nécessaires au processus (NoteBookLM, Midjourney, Grok, Gemini…) sont disponibles en version mobile, sur téléphone. On vit une époque formidable !
Un prompt engineer virtuel
J’ai déjà posté ici un comparatif des différentes IA « text to image » et de leurs résultats très différents justement, pour un même prompt. Cette fois ci, il s’agit de comparer les images obtenues dans chaque IA avec un prompt volontairement basique « Fractale en 3D sur un plan » et une version de ce prompt beaucoup plus détaillée. Pourquoi (encore) une fractale ? Parce que ! D’abord. Et puis je me dis que ce type de graphisme n’est pas aussi répandu que les photos de chats et que mes IA vont devoir se gratter la tête (de bits) pour sortir quelque-chose de potable.
Il existe tout un tas de solutions en ligne pour améliorer ses prompts. Sans parler des agrégateurs d’IA et de certains moteurs qui procède à cette réécriture, souvent même sans rien vous demander. Mais il est bien plus gratifiant de se créer une « moulinette » personnelle, une base de données des bonnes pratique pour chaque IA et NotebookLM est l’outil idéal pour cela.
J’ai donc crée à cet effet un dossier Notebook LM expert, contenant les docs officiels des principaux logiciels « text to image » : Gemini, Grok, MidJourney, Leonardo, Flux, JuggernautXL, Stable Diffusion… Et quelques vidéos et documents d’intérêt général concernant la génération de prompts efficaces. En tout 71 documents. Et bien entendu une configuration personnalisée dans les réglages fins : utiliser les réglages proposés par défaut ne donnent pas de bons résultats…
Je ne suis pas peu fier de ce nouvel outil qui fait de moi un « prompt engineer » distingué, une corporation très recherchée en entreprise et payée à sa juste valeur…
Mais il est temps de tester ce nouveau « workflow ». J’essaye la plupart des IA génératrices d’images à ma disposition. Beaucoup utilisent les moteurs de Black Forest Lab (Flux) de façon plus ou moins cachée et plus ou moins modifiés si bien que les résultats sont souvent brouillés. J’ai du faire l’impasse également sur des moteurs par trop protégés par leurs propriétaires (Mystic et Magnific de FreePik, de toute façon issus de Qwen et de Flux…), les innombrables moteurs à installer en local, plus ou moins clones de Stable Diffusion ou de modèles plus anciens, comme ceux utilisés par JWIlfire Swan, les non moins innombrables applis mobiles avec leurs ridicules filigranes et aussi de quelques applications asiatiques mal traduites. Mais il y a quand même de quoi faire pour étayer mon propos… Dans ce qui suit, les imagettes du dessus sont générées à partir du prompt minimal et celles pleine écran du dessous à l’aide d’un prompt générique « enrichi » voire dédié à l’IA considérée.
Les résultats sont très variables en fonction des IA. Souvent le prompt minimal donne lieu à des visuels variés et réussis mais seuls les prompts élaborés respectent le « cahier des charges » (ici à base de fractale en verre sur un plan en obsidienne polie).
Meta AI – Midjourney V8
Avec le prompt simple, directement dans l’application (MetaAI) : Fractale en 3D sur un plan
Ce qui est toujours troublant c’est que l’IA a parfaitement compris le prompt dans ce qu’il a pourtant de plus « exotique » : les fractales en 3D sont quand même un domaine assez peu connu ! Mais il y a moyen de faire bien mieux. En entrant ce prompt de base dans le répertoire NotebookLM précédemment concocté, je génère un prompt « générique » beaucoup plus élaboré, sur la base des documents chargés, sans préciser à quelle IA il est destiné :
« Voici une proposition de prompt optimisée, conçue selon les principes d’ingénierie de prompt extraits de votre documentation technique (notamment les frameworks pour FLUX.2 et Gemini Nano Banana) ».
Une structure fractale 3D ultra-complexe à l’auto-similarité géométrique infinie, émergeant d’un plan horizontal minimaliste en béton poli. Détails de surface micro-sculptés et textures cristallines irisées. Éclairage latéral dramatique (rim lighting) créant des ombres portées profondes pour souligner le relief et la profondeur. Style macro-photographique capturé avec un objectif 85mm, profondeur de champ courte avec arrière-plan flou, rendu 8K hyper-réaliste.
NotebookLM, à ma demande, génère aussi son raisonnement ce qui permet, éventuellement d’adapter le prompt :
- Framework de structure (FLUX.2) : J’ai appliqué la séquence préconisée : Sujet ? Environnement ? Détails ? Éclairage ? Atmosphère. Le sujet (la fractale) mène la danse, suivi immédiatement par son support (le plan de béton), ce qui permet au modèle de fixer les relations spatiales dès les premiers jetons (tokens).
- Priorisation sémantique (Word Order) : La documentation précise que les modèles (comme FLUX) accordent plus d’importance aux concepts mentionnés au début du prompt. Le terme « fractale 3D » est donc placé en tête pour garantir que l’aspect tridimensionnel prime sur la simple texture 2D.
- Spécificité vs Mots Clés génériques : Au lieu d’utiliser des termes vagues comme « magnifique » ou « incroyable » (explicitement déconseillés), j’ai utilisé des descripteurs concrets tels que « auto-similarité géométrique » et « textures cristallines irisées » pour guider l’IA vers une précision de rendu supérieure.
- Simulation Optique et Contrôle de Caméra : Pour renforcer l’effet 3D sur un plan, j’ai intégré des spécifications techniques de photographie professionnelle (« objectif 85mm », « profondeur de champ courte »). Selon la documentation, mentionner des réglages de caméra réels produit des résultats plus authentiques qu’un simple terme comme « photo professionnelle ».
Que demande le peuple ? 🙂 Toujours est-il que voilà le résultat et les 4 propositions d’images qui, on en conviendra, sont beaucoup plus réussies que celles générées avec le premier prompt minimal…
- Sémantique et Ordre des Mots (Word Order) : La documentation précise que les modèles accordent une importance accrue aux concepts placés en début de prompt. J’ai donc placé « 3D fractal structure » immédiatement en tête pour garantir que l’aspect tridimensionnel et la nature mathématique du sujet dominent la génération.
- Composants du Prompt : J’ai suivi le framework recommandé : Sujet + Milieu/Style + Environnement + Éclairage + Composition.
- Sujet : La fractale avec « auto-similarité géométrique infinie » pour guider l’IA vers une complexité mathématique précise.
- Milieu : « Macro photography » pour forcer un rendu réaliste des détails microscopiques.
- Environnement : Le « plan horizontal d’obsidienne » définit la surface de support tout en ajoutant des reflets qui renforcent la perception de la 3D.
- Contrôle Optique et Profondeur : Pour accentuer l’effet 3D « sur un plan », l’utilisation de termes techniques comme « shallow depth of field » (profondeur de champ courte) et « dramatic side lighting » (éclairage latéral dramatique) est essentielle pour créer du relief par le contraste ombre/lumière.
- Paramètres Techniques (Syntaxe rigoureuse) :
- –ar 16:9 : Par défaut, Midjourney génère des carrés (1:1). Le format panoramique est ici privilégié pour mieux exposer l’étendue du plan horizontal.
- –v 6.1 : Utilise la version la plus récente du modèle pour une netteté et une fidélité de texture optimales.
- –s 250 (Stylize) : Une valeur de 250 (par défaut à 100) permet d’ajouter un « flair » artistique et une complexité visuelle supplémentaire sans trop s’éloigner du prompt initial.
- Formatage : Les paramètres sont placés exclusivement à la fin, sans ponctuation entre eux, avec un espace après les tirets, conformément aux règles de succès édictées dans la documentation.
Gemini 3 – Nano Banana 2
De la même façon, dans Gemini 3, je commence avec le prompt minimal :
Le moins qu’on puisse dire c’est que ce modèle se débrouille très bien sans autres précisions, ce qui préfigure peut-être l’abandon prochain de toutes autres sophistications, à la manière de Grok.
Avec le prompt « générique » vu plus haut :
Enfin, avec un prompt dédié spécifiquement à Nano Banana 2 :
Une macrophotographie hyper-réaliste d’une structure fractale en 3D d’une complexité infinie, émergeant majestueusement d’un plan horizontal minimaliste en obsidienne noire polie. La géométrie fractale déploie des motifs auto-similaires cristallins qui captent la lumière. L’éclairage est assuré par un set de lumières latérales dramatiques, créant des ombres portées profondes qui soulignent le relief tridimensionnel et la profondeur de la structure. Prise de vue réalisée avec un objectif macro de 85mm à une ouverture de f/2.8, offrant une netteté chirurgicale sur les détails centraux tandis que l’arrière-plan s’efface dans un flou cinématique (bokeh) soyeux. L’atmosphère est monumentale et sereine.
Grok 4 – Flux
Avec le prompt minimal :
Voici une image générée avec Grok Imagine, interprétant ta demande. C’est une visualisation d’une fractale 3D (inspirée de concepts comme la Mandelbulb ou des reliefs fractals) qui se développe à partir d’un plan plat, comme un paysage mathématique infini.
Tu veux que je modifie quelque chose ? Par exemple :
- Plus de couleurs (vert/bleu, noir et blanc, etc.)
- Un type de fractale précis (Mandelbrot en relief, Julia, arbre fractale…)
- Un angle de vue différent (de dessus, en plongée…)
- Ou un style plus abstrait / réaliste ?
Dis-moi simplement ta nouvelle idée !
Encore une fois, c’est confondant… Signalons que, comme toujours, c’est l’IA la plus rapide ! Elon a la plus grosse (usine de données). Et bientôt dans l’espace ? Qu’est ce que ça va être !…
Avec le prompt générique « enrichi » :
Avec le prompt dédié à Flux :
Une structure fractale tridimensionnelle d’une complexité géométrique infinie, sculptée dans un matériau de verre dichroïque translucide, émergeant avec précision d’un plan horizontal minimaliste en obsidienne noire hautement polie. La lumière se fragmente à travers les motifs auto-similaires, générant des reflets internes irisés et des ombres portées nettes qui accentuent le relief. La composition suit une diagonale dynamique pour souligner la profondeur de l’objet. Photographie macro hyper-réaliste capturée avec un objectif 100mm f/2.8, éclairage de studio latéral dramatique (rim lighting), atmosphère sereine et technologique, rendu 8K aux détails ultra-précis.
Black Forest Lab – Flux
IA très performante sinon la meilleure, venue d’un éditeur allemand. C’est la base (cachée) pour un grand nombre de logiciels. Seule la version Pro est payante les autres sont des logiciels libres et qu’on peut installer en local. Les versions pro ont déjà été vues, via Grok, Mistral ou d’autres, alors j’ai essayé la version en local Schnell (rapide) :
Via Mistral (qui utilise Flux Pro), voici quelques versions, avec des corrections successives en terme de forme et de couleurs :
Recraft
Basé sur Flux, les résultats sont, sans surprise excellents.

Adobe – Firefly 3
C’est l’IA intégrée aux produits Adobe (Photoshop) dont les résultats sont époustouflants. Plus que la politique tarifaire d’Adobe, ses mises à jour débiles et son mépris pour la clientèle dont celle-ci se plaint de plus en plus, préférant des solutions libres. Dommage pour cette IA : il faut un abonnement.
PromeAI – Model V3
3 images issues du prompt basique suivies d’une grand format correspondant au prompt « enrichi » :
NVidia – Sana
Par le grand fabricant des puces GPU les plus performantes du marché. Fonctionne en ligne à une vitesse étonnante, basée sur une technologie qui semble très différente des autres sites du « Cloud ». Voici 3 images issues du prompt basique suivies d’une en grand format correspondant au prompt « enrichi » :
Wan
IA chinoise de très bonne qualité (une des meilleurs en fait). Voici 2 images issues du prompt basique suivies d’une en grand format correspondant au prompt « enrichi » :
Copilot – GPT 4
Comme toujours, plutôt que de s’exécuter, le machin me soumet d’abord à un véritable questionnaire pour tenter d’améliorer le prompt. C’est amusant au début, cette interaction, mais on se lasse vite. De plus la censure est omniprésente chez « OpenAI » et, personnellement cette société « Bisounous » et du contrôle généralisé m’insupporte. Raison pour laquelle j’ai abandonné cette IA malgré son intégration partout chez Windaube et même sur les claviers des PC…
Très bien, Francis. Une fractale en 3D sur un plan, c’est déjà une belle direction — mais pour créer une image qui corresponde exactement à ton intention, j’ai besoin de préciser trois éléments clés. Je vais rester concis et ciblé pour ne pas t’alourdir.
1. Type de fractale
Souhaites tu quelque chose de plutôt :
- Mandelbulb (organique, volumineux)
- Menger / éponge de Menger (géométrique, cubique)
- Julia 3D (plus fluide, complexe)
- Ou une fractale non spécifiée, juste esthétique et libre
2. Le plan
Comment imagines tu le plan sur lequel repose la fractale
- Un plan lisse (type sol neutre)
- Un plan réfléchissant (miroir, métal poli)
- Un plan texturé (pierre, sable, matière abstraite)
- Un plan infini ou un plateau flottant
3. Le style visuel
Tu veux une image plutôt :
- Photorealiste
- Sci-fi / néon
Après avoir contourné ce questionnaire à la « 1984 », voilà ce que donne le prompt « minimal » :
Avec le prompt « générique » :
Avec le prompt dédié à Copilot :
Une structure fractale tridimensionnelle d’une complexité géométrique infinie émergeant avec précision d’un plan horizontal minimaliste en quartz blanc poli. Photographie macro hyper-réaliste capturant les détails microscopiques des ramifications cristallines. La scène est éclairée par une lumière latérale dramatique qui souligne le relief 3D et projette des ombres allongées sur la surface plane. Prise de vue réalisée avec un objectif de 85mm à une ouverture de f/2.8, créant une netteté absolue sur le cœur de la fractale et une faible profondeur de champ avec un arrière-plan en bokeh soyeux.
Voici ton image, Francis — une fractale cristalline hyper-réaliste surgissant du quartz blanc, capturée avec toute la précision que tu avais imaginée. Si tu veux explorer d’autres variations — changement de lentille, de matériau, de type de fractale ou même une mise en scène plus monumentale — je suis prêt à t’accompagner dans chaque détail.
Merci ! Mais… Toujours ces « tirets quadratins » du plus mauvais goût que personne n’emploie (raccourci clavier : Alt + 0151) et qui font reconnaître instantanément que tel ou tel texte est généré par IA et même précisément par Copilot / GPT ! Les « écrivains » amateurs auto-édités devraient en tenir compte… Heureusement, les résultats sont à la hauteur.
GPT 4.5
Dall-E ou générateur maison xAI ? On n’en sait rien… En petit, le prompt basique et au dessous, l’enrichi pour Chat GPT…
Dall-E 3
C’est l’un des premiers moteurs d’IA tombé en désuétude. J’ai utilisé Copilot parce que cette IA fait appel à Dall-E pour la génération d’image. Encore que chez Microdaube, il faille s’attendre à tout… Et, en général, les gros éditeurs sont assez peu diserts sur leurs « sous-traitants »…
Une macrophotographie hyper-réaliste d’une structure fractale tridimensionnelle d’une complexité géométrique infinie, émergeant avec précision d’un plan horizontal minimaliste en marbre noir poli. La fractale présente des ramifications cristallines irisées qui captent la lumière. La scène est capturée avec un objectif macro Sigma 105mm à une ouverture de f/2.8, créant un piqué chirurgical sur les détails centraux et une profondeur de champ extrêmement courte qui floute subtilement l’arrière-plan. L’éclairage de studio est de type ‘low-key’ avec une lumière latérale dramatique pour sculpter le relief et projeter des ombres portées profondes sur la surface plane. Rendu Octane 3D de haute précision.
Duck Duck Go
Initialement un navigateur internet, ce soft peut connu permet aussi de générer des images ! Avec un quota par jour assez généreux. C’est rapide et plutôt efficace et la société vous garantit la confidentialité des requêtes et des données, à la manière de Brave. Ce qui en dit long sur l’utilisation de toutes vos données par les autres IA « gratuites »… Peut de précisons sur le moteur d’IA utilisé qui est sans doute Dall-E ou Stable Diffusion avec quelques adaptations.
Notons la possibilité de modifier les images point par point, à la manière de Nano Banana : Je n’ai pas pu m’empêcher de faire évoluer ma fractale vers le monde des minéraux et autres pierres dures.
Qwen
Moins connu en Europe, voici Qwen disponible gratuitement sur le web mais qu’on peut aussi installer en local, ou via API, etc. Une création d’Alibaba Group qui est un géant chinois du numérique fondé en 1999 par Jack Ma. Il domine le e-commerce mondial via des plateformes comme Alibaba.com (B2B), AliExpress (B2C international) et Taobao (Chine), tout en investissant dans le cloud, l’IA et la logistique. Le moins qu’on puisse dire est que c’est excellent et très compétitif !
D’abord le prompt minimal : Une fractale 3D sur un plan. C’est l’IA qui travaille seule, totalement libre. Comme toujours, c’est souvent excellent mais pas « dirigé ».
Puis, le prompt « enrichi » :
Une macrophotographie hyper-réaliste d’une structure fractale tridimensionnelle à l’auto-similarité géométrique infinie, émergeant majestueusement d’un plan horizontal minimaliste en obsidienne noire hautement polie. La fractale déploie des ramifications cristallines complexes qui accrochent la lumière latérale, créant des reflets internes irisés et des textures micro-sculptées. La scène est capturée avec un objectif macro de 105mm à une ouverture de f/2.8 et un ISO 100, offrant une netteté chirurgicale sur les détails fractals centraux tandis que l’arrière-plan s’efface dans un bokeh cinématique soyeux. Un éclairage latéral dramatique de type ‘rim lighting’ sculpte le relief physique de l’objet, projetant des ombres portées nettes et allongées sur la surface plane pour valider physiquement sa tridimensionnalité.
Cette IA m’en remet une couche avec ce petit texte de confortation :
Voici votre macrophotographie hyper-réaliste d’une structure fractale tridimensionnelle. L’image capture fidèlement les éléments techniques et artistiques demandés :
- Structure fractale : L’auto-similarité géométrique et les ramifications cristallines complexes sont visibles avec une netteté chirurgicale
- Surface en obsidienne : Le plan horizontal noir hautement poli reflète magnifiquement la structure, validant sa tridimensionnalité
- Éclairage dramatique : Le ‘rim lighting’ latéral sculpte le relief et crée des reflets internes irisés dans les cristaux
- Profondeur de champ : L’ouverture f/2.8 produit un bokeh cinématique soyeux qui fait ressortir les détails fractals centraux
- Ombres portées : Les ombres nettes et allongées sur la surface plane confirment physiquement la présence tridimensionnelle de l’objet
Seedream
Comme toujours, 3 images issues du prompt basique suivies d’une en grand format correspondant au prompt « enrichi » :

DrawThings – Stable Diffusion et ses amis
Cette fois, l’IA fonctionne en local et non dans le cloud sur les gros serveurs distants et donc, c’est évidement assez lent. J’ai commencé avec le modèle SD 3.5 V10 Turbo. Avec le prompt minimal, les résultats sont… Déroutants ! 🙂
Comme d’habitude j’ai demandé à NoteBookLM de le rendre spécifique, qui m’a répondu : En tant qu’ingénieur de prompt senior, j’ai conçu cette commande spécifiquement pour Stable Diffusion en m’appuyant sur les protocoles de performance détaillés dans votre documentation technique (notamment le Guide Stable Diffusion France).
Avec le modèle SD 3 Large 3.5, j’ai bien la toile mais guerre de contenu !
J’ai essayé d’augmenter le nombre de passe (de 4 à 8) pour avoir un résultat exploitable. Las…
J’ai donc choisi un autre échantillonneur (la liste donne le vertige, rien qu’à la voir ; avec des noms merveilleusement explicites comme Euler A Substep, DPM++ 2M Trailing, DDIM, DPM++ SDE AYS et autres joyeusetés…) Si quelqu’un y comprend quelque-chose, qu’il n’hésite pas à m’écrire ! Mais cette fois, la qualité est au rendez-vous. Ces quartz fractals sont très réussis :
Avec Juggernaut XL X (échantillonneur DPM++ 2M AYS), on voit clairement la différence :
Avec Juggernaut XL_V8 Rundiffusion (prompt dédié)
Avec HiDream :
Avec Z-Image.ai :
- Prompt minimal
- Prompt enrichi
Avec Aura-Flow (oui, c’est de la merde, vous avez le droit de le dire) :
- Basique
- Elaboré…
Avec Pixart-Sigma : Oui on continue dans l’inommable…
Rêve AI
Retour aux rendus corrects…
Higgsfield
Freepik – Mystic
Leonardo – Phoenix 1
La version du prompt basique donne des résultats assez surprenant ! Tout comme la version détaillée, d’ailleurs. Ce n’est plus de « l’hallucination » mais de la toxicomanie ! 🙂
Ideogram
Jadis spécialisée dans les textes (aujourd’hui toutes le font) cette IA donne néamoins toujours d’assez bons résultats.
Apple – Image Playground
Sans commentaires… Apple a bel et bien loupé le virage de l’IA…
Claude
J’ai gardé pour la fin Claude d’Anthropic dont on parle beaucoup en ce moment. Avec tout un tas de parfums parmi lesquels on se perd facilement : Sonnet, Haïku, Opus, Code… Et encore plus d’interfaces : une application de bureau, une mobile (iOS), une interface web, une pour le terminal (CLI), une autre directement chez Anthropic pour piloter Claude avec une API…
A l’intérieur, c’est encore pire avec les subtilités de Claude Code, Cowork, les agents, les assistants, les plugins, les liaisons MCP… Les spécialistes qui maîtrisent la bête disent qu’elle « plie le game » ! Pour ma part j’explore l’équivalent chez Google avec Gemini et ses Gems, NotebookLM et le nouveau Antigravity. Plus quelques outils beta sur Google AI Studio… Tout ceci méritera un nouveau billet, soyons en sûrs !
Quoiqu’il en soit, on est loin du simple prompt et du processus basique qui donne une image auquel on est habitué. Tout simplement parce que Claude (enfin… Eux – ils sont nombreux) n’est pas du tout un générateur d’images. Il n’a même pas la condescendance de nous relier à un autre générateur d’images, comme font les autres (Meta, Copilot, Freepik, Weavy)…
Comme j’ai insisté, avec mon prompt ridicule « Fractale 3D sur un plan », le truc s’est mis à mouliner tout seul pendant plusieurs minutes et a accouché d’une nouvelle application complète ! En html (Js et Canvas) consultable et utilisable comme une simple page web. Je voulais une simple image, j’ai obtenu un logiciel ! Ca m’apprendra..
Oui, ça pique ! Le monde qui arrive va être « Rock & Roll »… 🙂
L’avènement des « Ghost Writers »
Alors, jusqu’à présent, j’appréciais le « fait main ». Et pour tout dire, au cours de mes différentes activités d’édition (presse, internet, télévision, livres..), il n’y avait pas moyen de faire autrement. Mais ça – comme disait un rubriqueur de télé célèbre, c’était avant !
Aujourd’hui les écrivains deviennent des « metteurs en livres », les journalistes des « copieurs/colleurs » (ce qui n’est pas très différents de leurs habitudes avec les dépêches AFP et autres « éléments de langage »), les influenceurs et autres youtou-beurre des « répétiteurs – perroquets 2.0″…
Des utilisateurs de X (ex Twitter) révèlent même que leur contenu (bien structuré, sourcé, long et juste) est produit à 80 % par l’IA. Quand à LinkedIn aujourd’hui, on se demande ce qui n’est pas écrit par des machines…
J’ai évidement dressé un robot à écrire à ma place des articles pour ce blog. Ce n’est pas encore parfait mais on s’approche… A titre d’essai, et sans changer une virgule, voici ce que donne un billet automatisé sur ce sujet des prompts. Vous pouvez lire, c’est pertinent !
Maîtriser l’art de l’imprévisible : 5 Secrets révélés pour vos Images IA en 2026
Le Paradoxe de la Perfection Algorithmique
En 2026, la création par intelligence artificielle a atteint une maturité technique sans précédent. Pourtant, les créateurs chevronnés se heurtent à un paradoxe frustrant : la « perfection » native des algorithmes produit souvent des visuels trop lisses, prévisibles, voire dénués d’âme. Pour l’artiste numérique, le défi n’est plus de générer une image nette, mais d’injecter de l’originalité et de l’organique dans un flux de données standardisé.
La véritable maîtrise réside désormais dans l’exploitation de paramètres techniques souvent ignorés. En explorant les subtilités de Midjourney V8 Alpha et la flexibilité des modèles Aurora de xAI, il est possible de transformer l’IA d’un simple exécutant en un partenaire de création capable de nous surprendre.
——————————————————————————–
Secret n°1 : La variance contrôlée via le paramètre –chaos (Midjourney)
Pour briser la monotonie des quatre variantes initiales, le levier le plus puissant reste le paramètre --chaos (ou --c). Dans la version V8 Alpha, ce paramètre a été affiné pour offrir une sérendipité stratégique. Par défaut, la valeur est de 0, ce qui contraint l’IA à rester extrêmement proche de son interprétation primaire.
- L’échelle d’exploration : De 0 à 100.
- Analyse de l’expert : Un chaos élevé (au-delà de 60) autorise l’algorithme à s’éloigner radicalement du « chemin sûr » défini par le prompt. Si la fidélité initiale peut sembler moindre, c’est ici que naissent les esthétiques hybrides imprévues.
- Flux de travail optimisé : Pour gagner en efficacité, vous pouvez fixer une valeur de variété par défaut via le panneau
/settings(bouton « Variety »). Cela permet d’injecter une dose de surprise systématique dans chaque génération sans retaper le paramètre.
« Des valeurs de chaos plus élevées signifient que les images peuvent être très différentes et peuvent ne pas coller aussi étroitement à votre prompt, vous offrant des résultats imprévisibles. »
——————————————————————————–
Secret n°2 : Distinguer Aurora d’Aurora Flux pour une liberté accrue (Grok)
En 2026, l’écosystème Grok sur X Premium offre une alternative majeure aux outils traditionnels. Cependant, l’expert doit savoir jongler entre les deux nuances du modèle :
- Modèle Aurora (Défaut) : C’est le roi incontesté du photoréalisme et de la restitution anatomique des visages humains. Il surpasse ses concurrents là où les traits deviennent souvent « plastiques ».
- Modèle Aurora Flux : Cette variante excelle dans les styles artistiques variés et les compositions graphiques complexes. C’est l’outil privilégié pour l’art abstrait ou les mèmes.
Note stratégique sur l’éthique : Si Grok offre une liberté de création accrue avec des restrictions de contenu plus souples, il maintient des garde-fous stricts sur la représentation des personnalités publiques. Pour éviter des blocages de compte inutiles, concentrez votre créativité sur des personnages originaux ou des archétypes.
——————————————————————————–
Secret n°3 : La structure sémantique et l’optimisation du format
Contrairement à Midjourney qui privilégie parfois une syntaxe de « tokens » obscurs, Grok répond mieux à une structure de prompt fluide, directe et descriptive. Pour une « qualité muséale », utilisez cette formule en 6 points :
[Sujet] + [Style / Support] + [Environnement] + [Éclairage] + [Atmosphère] + [Détails techniques]
L’importance de l’affinage itératif est illustrée par l’exemple du « Dragon oriental » :
- Phase 1 : « Dragon survolant des montagnes » (trop générique).
- Phase 2 : « Dragon oriental survolant des sommets chinois embrumés, style peinture à l’encre traditionnelle ».
- Phase 3 (Expert) : « Dragon chinois serpentin naviguant entre les pics du mont Huangshan, style lavis traditionnel de la dynastie Song avec touches subtiles de rouge, composition en rouleau suspendu. »
Le format comme outil de composition : Un expert ne laisse jamais l’IA choisir le ratio. Adaptez vos dimensions directement dans le prompt selon l’usage :
- 1:1 : Réseaux sociaux (carré).
- 3:1 : Bannières Twitter/X.
- 9:16 : Smartphone / TikTok.
- 16:9 : Fonds d’écran paysage.
- 2:3 : Pinterest.
——————————————————————————–
Secret n°4 : Le piège de la modération sémantique (–no)
Dans Midjourney, le paramètre --no est une arme à double tranchant. L’algorithme lit chaque mot de l’exclusion de manière indépendante.
- Le risque : Utiliser
--no modern clothingpour une scène historique sera lu comme « no modern » ET « no clothing ». Cela peut déclencher accidentellement une alerte de modération NSFW (nudité) et un avertissement sur votre compte. - La solution Midjourney : Décrivez ce que vous voulez (ex: « vêtements médiévaux en laine ») au lieu de ce que vous excluez.
- L’avantage Grok : Grok gère beaucoup mieux les « Negative Prompts ». Vous pouvez lister clairement les exclusions : « À exclure : style dessin animé, anime, traits déformés, doigts surnuméraires ». Cette flexibilité permet un nettoyage chirurgical de l’image sans risque de censure injustifiée.
——————————————————————————–
Secret n°5 : La Fusion de Styles et le contournement des mains déformées
La signature d’un artiste en 2026 est la « Style Fusion ». Grok Aurora est particulièrement apte à générer du Réalisme Magique en fusionnant des influences contradictoires.
- Exemple : « Fusion entre le style Studio Ghibli et la photographie National Geographic. » Le résultat offre un équilibre fascinant entre féerie visuelle et précision texturale organique.
Note d’Expert : Corriger l’anatomie Malgré les progrès, le rendu des mains reste un défi. Pour Grok, appliquez ces trois astuces :
- Précisez explicitement l’exigence de « mains anatomiquement correctes ».
- Utilisez des ruses de mise en scène : « mains dans les poches » ou derrière des éléments du décor.
- Privilégiez des poses où les mains sont naturellement moins visibles pour maximiser le réalisme global.
« La maîtrise repose avant tout sur l’expérimentation : utilisez les modèles de prompts comme point de départ, puis affinez-les au fil de vos itérations. »
——————————————————————————–
Vers une Créativité Augmentée
En 2026, les outils comme Midjourney V8 et Grok Aurora Flux ne sont plus de simples générateurs, mais de véritables partenaires capables de capturer l’imperfection humaine. La maîtrise technique n’est plus une fin en soi, mais un moyen de guider l’IA vers la sérendipité. En comprenant la sémantique profonde et en jouant avec le chaos contrôlé, vous passez du rôle de spectateur à celui de réalisateur augmenté.
Et si la plus grande force de l’IA n’était pas de suivre vos ordres, mais de vous surprendre là où vous ne l’attendiez pas ?












































































































































0 commentaires