Presque tous ceux qui commencent à générer des images avec l'IA passent des mois à essayer d'améliorer les résultats uniquement par le texte du prompt : remplacer « beau » par « éblouissant », ajouter « 8K », « ultra détaillé », « chef-d'œuvre ». Et le résultat reste semblable. La raison est simple : une bonne partie de ce qui définit l'image finale ne se trouve pas dans le texte, mais dans les paramètres.

Les paramètres sont les commandes numériques qui indiquent au modèle comment dessiner, et non quoi dessiner. Proportion de la toile, degré d'obéissance à votre texte, nombre d'étapes de raffinement, graine aléatoire utilisée, liberté esthétique accordée. Ce sont eux qui séparent celui qui génère dix variations au hasard de celui qui parvient à répéter, ajuster et faire évoluer une image de manière maîtrisée.

Ce guide est une référence technique des cinq paramètres présents dans pratiquement tous les outils — ratio d'aspect, seed, CFG, stylize et steps — ainsi que de quelques voisins qui méritent d'être connus. L'idée est que vous puissiez y revenir chaque fois que vous avez besoin de vous rappeler ce que fait chaque valeur, dans quelle plage agir et ce qui casse lorsque vous exagérez.

Pourquoi les paramètres comptent plus que les adjectifs

Un modèle de diffusion part d'un bruit pur et « nettoie » progressivement ce bruit jusqu'à obtenir une image. Le prompt fonctionne comme une carte de la destination ; les paramètres définissent la route, la vitesse et la marge d'improvisation laissée au conducteur.

Cela explique pourquoi deux prompts identiques génèrent des images complètement différentes, et pourquoi ajouter des adjectifs ne change souvent rien. Si le modèle a déjà une faible obéissance au texte (CFG bas), ajouter des mots ne sert à rien : il ne leur prête tout simplement pas beaucoup d'attention. Si les steps sont trop bas, aucun adjectif ne sauvera la texture de l'image, car le modèle n'a pas eu assez d'itérations pour résoudre les détails.

La pratique qui distingue les débutants des utilisateurs expérimentés est la suivante : modifiez un paramètre à la fois. Si vous changez le prompt, le seed et le CFG lors de la même tentative, vous ne saurez pas ce qui a causé l'amélioration. En fixant le seed et en ne touchant qu'au CFG, vous isolez la variable et apprenez réellement comment ce modèle se comporte.

💡 Conseil : avant d'optimiser quoi que ce soit, générez quatre images avec le même prompt et les paramètres par défaut. Elles montrent le point de départ du modèle. Ce n'est qu'ensuite qu'il faut commencer à modifier les valeurs, et toujours une par une.

Ratio d'aspect : la proportion qui définit le cadrage

Le ratio d'aspect est la relation entre la largeur et la hauteur de l'image. Dans Midjourney, il s'écrit --ar 16:9 ; dans Stable Diffusion et ses dérivés, vous définissez la largeur et la hauteur en pixels ; dans ChatGPT et Gemini, il suffit généralement de le demander en langage naturel (« format portrait 9:16 »).

C'est le paramètre qui paraît le plus banal de la liste, mais c'est celui qui influence le plus la composition. Le modèle ne se contente pas de recadrer la même scène dans des formats différents : il recompose. Un portrait demandé en 16:9 tend à devenir un plan moyen avec un arrière-plan large ; le même prompt en 2:3 devient un gros plan vertical classique de photographie. La proportion change ce que l'IA considère comme le « cadrage naturel » de cette scène.

Les valeurs les plus utilisées et leur usage

ProportionUsage typiqueCe que le modèle a tendance à faire
1:1Avatar, fil Instagram, icône, vignette produitCentre le sujet, simplifie l'arrière-plan
4:5Publication verticale Instagram et FacebookPlan moyen, forte présence du sujet
2:3Portrait photographique, affiche, couverture de livreGros plan ou plan américain, style éditorial
9:16Stories, Reels, TikTok, fond d'écran mobileComposition verticale, beaucoup d'espace en haut et en bas
16:9Miniature YouTube, bannière, scène cinématographiquePlan large, paysage, contexte autour
21:9Cinématographique ultra-large, bandeau de sitePanoramique, sujet petit dans le cadre
3:1Bannière d'en-tête, couverture LinkedInBande horizontale ; exige souvent un prompt très précis

Un piège fréquent : les proportions très extrêmes (comme 3:1 ou 1:3) déroutent les modèles entraînés majoritairement sur des images proches du carré. La duplication est courante — deux visages, deux têtes, des éléments répétés sur les bords — car le modèle tente de « remplir » un espace pour lequel il n'a pas de référence solide. Dans ces cas, la voie la plus sûre consiste à générer en 16:9 puis à utiliser le recadrage ou l'expansion par outpainting pour atteindre le format final.

Autre point pratique : générer directement au bon ratio vaut toujours mieux que recadrer ensuite. Le recadrage supprime des pixels et réduit la résolution utile. Si vous avez besoin de la même image dans plusieurs formats, générez-la dans le plus contraignant (généralement le vertical) et adaptez les autres par un redimensionnement maîtrisé.

Seed : le nombre qui rend le résultat reproductible

Le seed est le nombre entier qui initialise le bruit aléatoire dont naît l'image. Même prompt + même seed + mêmes paramètres + même modèle = la même image, pixel pour pixel. Changez le seed, et tout change.

C'est probablement le paramètre le plus sous-utilisé par les débutants, et le plus important pour qui travaille avec l'IA de façon professionnelle. Sans maîtriser le seed, vous ne pouvez pas itérer : vous ne pouvez que retirer au sort.

Les usages pratiques sont au nombre de trois :

Une limite importante mérite d'être comprise : le seed est propre au modèle et à la version. Le seed 42 sur SDXL ne produit rien de comparable au seed 42 sur Flux. Si vous changez de modèle, vos anciens seeds deviennent des nombres sans signification. Notez donc toujours modèle + version + seed ensemble, jamais le seed seul.

💡 Conseil : lorsqu'une génération est réussie, enregistrez immédiatement l'ensemble complet : prompt, prompt négatif, seed, CFG, steps, sampler, modèle et proportion. Un simple tableur avec ces colonnes vaut mieux que n'importe quelle collection d'images éparses : sans ces données, un excellent résultat est irreproductible.

Échelle CFG : à quel point l'IA obéit à votre prompt

CFG signifie Classifier-Free Guidance, et l'échelle de CFG contrôle le poids que le modèle accorde à votre texte par rapport à ce qu'il « aimerait » dessiner de lui-même. En pratique, c'est un bouton d'obéissance.

Les valeurs basses laissent le modèle créatif et libre, mais il commence à ignorer des parties du prompt. Les valeurs hautes forcent une adhérence littérale, mais l'image devient saturée, avec des contours durs, un contraste exagéré et un aspect artificiel : le fameux rendu « surcuit ».

Plage de CFGComportementQuand l'utiliser
1–3Ignore presque le prompt ; résultat imprévisible et éthéréExploration artistique, textures abstraites
4–6Interprétation libre, couleurs douces, apparence plus naturellePhotoréalisme, portraits, scènes organiques
7–9Équilibre entre obéissance et naturel : la plage par défautUsage général ; point de départ recommandé
10–14Forte adhérence au texte, couleurs plus intensesIllustration, design graphique, compositions précises
15+Saturation, artefacts, bords durs, distorsionsRarement utile ; seulement dans des cas très spécifiques

Un détail qui déroute beaucoup de monde : les modèles plus récents utilisent des plages différentes. Flux, par exemple, fonctionne avec sa propre échelle de guidance où les valeurs entre 2 et 4 sont normales — y mettre 7 est déjà élevé. Les modèles « turbo » et distillés, conçus pour tourner en peu de steps, demandent généralement un CFG entre 1 et 2. Autrement dit : il n'existe pas de nombre universel, seulement le bon nombre pour ce modèle. Consultez toujours la recommandation de celui qui a publié le checkpoint avant de supposer que 7 est la valeur par défaut.

Symptôme pratique d'un CFG trop élevé : peau à l'aspect plastique, couleurs néon, halo sombre autour des contours, texte ou motifs répétés de manière agressive. Symptôme d'un CFG trop bas : l'image est belle, mais la moitié de ce que vous avez demandé n'y est pas.

Stylize : l'esthétique propre au modèle

Le paramètre --stylize (ou --s) est propre à Midjourney et contrôle dans quelle mesure le modèle applique sa propre sensibilité artistique par-dessus votre demande. C'est presque l'opposé conceptuel du CFG : au lieu de mesurer l'obéissance au texte, il mesure la liberté esthétique.

L'échelle va de 0 à 1000, avec 100 par défaut. En pratique :

Il existe un paramètre frère souvent confondu avec celui-ci : --chaos (ou --c, de 0 à 100), qui contrôle la variété entre les quatre images d'un même lot, et non le style de chacune. Un chaos élevé livre quatre interprétations radicalement différentes du même prompt : excellent pour un brainstorming initial, désastreux lorsque vous savez déjà ce que vous voulez. Il y a aussi --weird, qui injecte une étrangeté délibérée et relève davantage de l'expérimentation que du travail client.

En dehors de Midjourney, il n'existe pas d'équivalent direct au stylize. Un effet similaire s'obtient autrement : LoRAs de style, mots-clés esthétiques dans le prompt, ou réglage fin du CFG. Le concept mérite tout de même d'être connu, car la logique du « combien de personnalité le modèle peut-il apporter » se retrouve sous des formes différentes dans presque tous les outils.

Steps : combien d'itérations le modèle exécute

Les steps (ou étapes d'échantillonnage) désignent le nombre d'étapes du processus de suppression du bruit. Chaque step rapproche un peu plus l'image du résultat final. Plus de steps signifie plus de temps de traitement et, jusqu'à un certain point, plus de détail.

Le point clé est ce jusqu'à un certain point. Ce paramètre présente un rendement décroissant très net : la différence entre 10 et 25 steps est énorme ; entre 30 et 60 elle est subtile ; au-delà de 80 elle est pratiquement imperceptible, et vous ne faites que dépenser du temps et de l'énergie.

StepsRésultatRemarque
1–8Ne fonctionne que sur les modèles turbo/distillésSur les modèles normaux, le rendu est flou et incomplet
10–20Brouillon rapide, formes définies, détail faibleBon pour tester la composition et le prompt
25–35Qualité de production dans la plupart des casPlage recommandée par défaut
40–60Gain marginal sur les scènes très complexesNe vaut le coup qu'avec beaucoup d'éléments
80+Aucun gain perceptiblePerte de temps et de traitement

Steps et sampler sont directement liés. Les samplers de type DPM++ 2M Karras convergent vite et donnent de bons résultats autour de 25 steps. Les samplers comme Euler a (ancestral) ne convergent jamais complètement : l'image continue de changer à mesure que vous augmentez les steps, ce qui peut être bon (plus de variation à explorer) ou mauvais (cela nuit à la reproductibilité). Si votre objectif est la cohérence, privilégiez les samplers non ancestraux.

Une décision pratique de flux de travail : menez l'exploration initiale avec peu de steps (15–20) pour tester rapidement des dizaines de prompts, et ne refaites que la version finale, avec le seed gagnant, à 30–40 steps. Cela économise beaucoup de temps par rapport à tout exécuter en qualité maximale dès le départ.

Les paramètres voisins à connaître également

Au-delà des cinq principaux, certaines commandes reviennent souvent et résolvent des problèmes précis :

Quels paramètres existent dans chaque outil

La nomenclature varie beaucoup d'une plateforme à l'autre, ce qui explique une bonne part de la confusion. Ce tableau met les équivalents en correspondance :

OutilRatio d'aspectSeedCFG / guidanceStepsStylize
Midjourney--ar 16:9--seed 1234Non exposéNon exposé--s 100
Stable Diffusion / ComfyUILargeur × hauteurChamp SeedCFG ScaleSampling stepsVia LoRA ou prompt
FluxLargeur × hauteurChamp SeedGuidance (2–4)20–30 typiqueVia LoRA ou prompt
ChatGPT / GPT ImageLangage naturelNon exposéNon exposéNon exposéVia prompt
Gemini / Nano BananaLangage naturelNon exposéNon exposéNon exposéVia prompt
Leonardo AIPréréglages + personnaliséChamp SeedGuidance ScaleOuiPréréglages de style

Remarquez la constante : plus l'outil est destiné à l'utilisateur final (ChatGPT, Gemini), moins il expose de paramètres — la plateforme décide à votre place. Plus il est proche du modèle brut (ComfyUI, Automatic1111), plus vous avez de contrôle. Aucune des deux approches n'est supérieure ; elles répondent à des objectifs différents. Si votre travail dépend de la reproduction des résultats, vous finirez par avoir besoin d'un outil qui expose le seed et le CFG.

Comment les paramètres interagissent : recettes par objectif

Les paramètres ne fonctionnent pas isolément. Ces combinaisons sont des points de départ éprouvés ; ajustez-les à votre modèle :

ObjectifProportionCFGStepsRemarque
Portrait photoréaliste2:3 ou 4:54–630Un CFG bas évite la peau plastique
Photo de produit1:17–930–35Fond neutre dans le prompt
Miniature YouTube16:99–1225CFG élevé pour des couleurs franches
Illustration / art conceptuel16:9 ou 21:97–1030Stylize élevé sur Midjourney
Logo et marque1:18–1230Stylize bas pour la fidélité
Fond d'écran mobile9:166–935Laissez de l'espace libre pour les icônes
Test rapide de prompt1:1715Uniquement pour valider l'idée

La logique derrière ces choix est cohérente : le photoréalisme demande un CFG bas (le modèle sait déjà à quoi ressemble une photo ; le forcer gâche tout) ; le design graphique et les supports promotionnels demandent un CFG élevé (vous voulez exactement ces éléments, dans ces couleurs) ; et les steps ne montent que lorsque de nombreux détails fins se disputent l'espace dans la scène.

Erreurs fréquentes et comment les corriger

Liste de contrôle avant de générer

  1. Définissez la proportion selon la destination finale de l'image, et non selon le réglage par défaut de l'outil.
  2. Commencez par les valeurs par défaut du modèle, et vérifiez lesquelles c'est, car elles varient.
  3. Faites un test peu coûteux : steps bas, quatre variations, simplement pour valider la direction.
  4. Choisissez la meilleure variation et notez le seed.
  5. Avec le seed fixé, ajustez un paramètre à la fois jusqu'à atteindre le résultat voulu.
  6. Refaites la version finale avec des steps de production (30–40).
  7. Consignez prompt, négatif, seed, CFG, steps, sampler, modèle et proportion.
  8. Effectuez la post-production : upscale, recadrage, réglage de netteté et compression pour le web.

Après la génération : l'étape que presque tout le monde saute

Une image générée par IA est rarement prête à publier. Elle arrive généralement en PNG lourd, à la résolution native du modèle, sans le recadrage exact qu'exige votre canal. Cette étape finale de traitement est ce qui sépare une image « d'IA » d'une image qui fonctionne simplement sur votre site ou votre profil.

La routine de base de post-production est courte : ajustez le cadrage par recadrage lorsque la proportion finale ne correspond pas exactement ; amenez-la à la dimension exacte de la destination par redimensionnement ; récupérez le micro-détail avec le réglage de netteté si l'image a été agrandie ; et enfin, convertissez-la en WebP et compressez-la avec le compresseur, car un PNG de 4 Mo en haut de page fait chuter le PageSpeed quelle que soit la qualité du visuel.

Si l'image doit intégrer une identité visuelle, le parcours se poursuit dans d'autres outils : extrayez la palette avec le générateur de palette de couleurs pour maintenir la cohérence entre les pièces, et utilisez le créateur de logo avec IA lorsque l'objectif est la marque.

Mettez vos images d'IA au bon format

Une fois les paramètres réglés, amenez l'image à la dimension exacte de sa destination : gratuit, directement dans le navigateur et sans rien envoyer à un serveur.

Redimensionner une image

Questions fréquentes

Quelle est la valeur idéale de CFG pour des images réalistes ?
Sur la plupart des modèles dérivés de Stable Diffusion, la plage entre 4 et 6 donne le résultat le plus naturel pour le photoréalisme, car les valeurs élevées créent une peau plastique et un contraste exagéré. Sur Flux, qui utilise une échelle de guidance différente, l'équivalent se situe généralement entre 2 et 4. Vérifiez toujours la recommandation spécifique du modèle que vous utilisez avant de supposer une valeur par défaut.
Le même seed génère-t-il la même image dans des outils différents ?
Non. Le seed n'est reproductible qu'au sein du même modèle, dans la même version et avec les mêmes paramètres. Le seed 12345 sur SDXL n'a aucun rapport avec le seed 12345 sur Flux ou Midjourney. C'est pourquoi il est essentiel de noter le modèle et la version à côté du nombre : le seed isolé ne porte aucune information utile.
Augmenter les steps améliore-t-il toujours la qualité de l'image ?
Non. Le gain est très important jusqu'à environ 25 à 30 steps, puis il chute rapidement. Au-delà de 60, la différence est pratiquement imperceptible, et au-delà de 80 vous ne dépensez que du temps de traitement. Si l'image présente des problèmes d'anatomie ou des éléments manquants, le coupable est le prompt ou le modèle, pas le nombre de steps.
Quelle est la différence entre stylize et chaos dans Midjourney ?
Le stylize contrôle à quel point le modèle applique sa propre esthétique artistique par-dessus votre demande, ce qui affecte l'éclairage, la palette et la composition de chaque image. Le chaos contrôle la variété entre les quatre images d'un même lot : avec un chaos élevé, vous recevez quatre interprétations très différentes du même prompt. Utilisez un chaos élevé en phase d'exploration et bas une fois la direction connue.
Pourquoi des personnes ou des objets dupliqués apparaissent-ils dans l'image ?
Cela se produit généralement lorsque la proportion est très extrême ou que la résolution dépasse largement celle sur laquelle le modèle a été entraîné. Le modèle tente de remplir l'espace supplémentaire en répétant des éléments qu'il reconnaît déjà. La solution consiste à générer dans une proportion plus proche du carré ou du 16:9, à la résolution native du modèle, puis à étendre par outpainting ou à agrandir par upscale.
Comment contrôler les paramètres dans ChatGPT ou Gemini, qui n'exposent pas ces champs ?
Ces outils masquent les commandes numériques et décident des valeurs en interne ; le réglage passe donc par le langage naturel dans le prompt lui-même : demandez le format explicitement, décrivez le niveau de détail et indiquez si vous souhaitez une lecture plus littérale ou plus artistique de la scène. Si votre travail exige une reproductibilité exacte, la voie à suivre est d'utiliser un outil qui expose le seed et le CFG, comme ComfyUI, Automatic1111 ou Leonardo AI.