Créer des images avec ChatGPT n'est plus une fonctionnalité secondaire : c'est devenu l'une des choses que l'outil fait le mieux. Depuis avril 2026, la génération d'images fonctionne sur ChatGPT Images 2.0, un modèle natif qui a définitivement remplacé DALL·E — retiré en mai de la même année — et qui a résolu le problème le plus persistant de toute IA d'image : écrire du texte à l'intérieur de l'image sans se tromper dans les lettres.

Cela change le type de choses qu'on peut faire. Une affiche avec un titre lisible, un infographique avec des chiffres corrects, une couverture avec le nom de la marque, une page de bande dessinée avec des dialogues, une maquette d'emballage avec une étiquette — tout cela sortait de travers auparavant et sort désormais propre dans la plupart des tentatives.

Ce guide couvre le parcours complet : comment générer la première image, comment écrire le prompt de la façon dont ChatGPT le comprend le mieux, comment éditer sans tout régénérer, comment garder le même personnage entre les images, ce qui change entre le plan gratuit et le plan payant, et ce que l'outil ne fait pas encore bien.

Ce qui a changé dans la génération d'images de ChatGPT

Jusqu'en 2025, ChatGPT générait des images en faisant appel à DALL·E comme système séparé : vous écriviez, il traduisait votre demande en un prompt interne et l'envoyait à un autre modèle. Le résultat était irrégulier, car il y avait une traduction intermédiaire que vous ne contrôliez pas.

Aujourd'hui, le modèle d'image est natif et partage le contexte avec le modèle de langage. En pratique, cela signifie qu'il comprend la demande de la même façon qu'il comprend une question textuelle : si vous dites « fais une affiche pour un café qui ouvre à 7h à Porto Alegre », il n'a pas besoin que vous décriviez chaque élément visuel — il déduit la mise en page, la hiérarchie et le contenu.

Trois conséquences pratiques comptent plus que les autres :

💡 À savoir : les limites de génération d'images du plan gratuit ne sont pas communiquées officiellement et évoluent selon la demande sur la plateforme. Considérez tout chiffre trouvé ailleurs comme une estimation, pas une règle fixe.

Comment générer votre première image, étape par étape

Le flux est aussi simple que possible — il n'existe ni panneau séparé ni configuration préalable obligatoire.

  1. Ouvrez une nouvelle conversation. Aucun mode spécial à sélectionner ; il suffit de demander.
  2. Décrivez l'image en langage naturel. Écrivez comme si vous expliquiez à un designer, en phrases complètes. N'utilisez pas de liste de mots séparés par des virgules : ce format vient d'autres outils et rend moins bien ici.
  3. Indiquez le format. « Format vertical pour stories », « carré pour Instagram », « horizontal 16:9 ». Si vous ne le dites pas, il choisit seul.
  4. Attendez la génération. Les images prennent plus de temps que les réponses textuelles, surtout celles à mise en page dense.
  5. Demandez des ajustements dans la même conversation. « Assombris le fond », « agrandis le titre », « change la couleur du manteau en rouge ». Il garde l'image et modifie seulement ce que vous avez demandé.
  6. Téléchargez en pleine résolution. Utilisez le bouton de téléchargement, pas une capture d'écran — la capture perd en qualité et arrive à la taille de votre fenêtre.

Ce dernier point est plus important qu'il n'y paraît. Beaucoup de gens enregistrent l'image en cliquant droit sur la miniature et se retrouvent avec un petit fichier recompressé.

Les deux modes : instantané et raisonnement

ChatGPT Images 2.0 fonctionne selon deux modes, et comprendre la différence évite bien des frustrations.

Le mode instantané génère directement à partir de votre demande. Il est rapide, disponible sur tous les plans y compris le gratuit, et couvre bien les images simples : une scène, un portrait, une illustration, un fond.

Le mode avec raisonnement — le « thinking » — fait planifier le modèle avant de dessiner : il vérifie le nombre d'objets, contrôle les contraintes demandées, organise la mise en page et, si nécessaire, effectue une recherche web pour intégrer une information actualisée dans l'image. C'est ce mode qui produit un infographique correct, une affiche avec des données réelles et une composition avec de nombreux éléments alignés. Il est réservé aux plans payants.

En pratique : si votre demande concerne une seule scène, le mode instantané suffit. S'il y a un comptage (« exactement cinq icônes »), une hiérarchie de texte ou des données qui doivent être exactes, le raisonnement fait une vraie différence.

Comment écrire des prompts que ChatGPT comprend le mieux

Voici la plus grande différence entre ChatGPT et des outils comme Midjourney : il préfère la prose à une liste de tags. Écrire « femme, 35 ans, blazer gris, bureau, 85mm, bokeh » fonctionne, mais rend moins bien que la même information en phrases.

Commencez par la fonction de l'image, pas la description

Dire à quoi elle sert change tout le résultat. « Une affiche promotionnelle pour l'atelier photo du 12 » produit quelque chose de bien plus utilisable que « une image avec un appareil photo et du texte ». Le modèle utilise la finalité pour décider de la hiérarchie, de l'espace et du style.

Écrivez le texte exact entre guillemets

Quand l'image doit contenir des mots, écrivez-les littéralement et entre guillemets : le titre « Petit-déjeuner », le sous-titre « tous les samedis, de 8h à 11h ». Sans guillemets, le modèle peut paraphraser ou inventer. Et indiquez où se trouve chaque texte : en haut, en bas, dans le coin inférieur droit.

Décrivez la structure avant le style

L'ordre qui fonctionne est : ce qui apparaît et où → puis à quoi ça ressemble. « Trois colonnes égales, icône en haut de chacune, titre en dessous et un court paragraphe en bas ; style minimaliste avec fond beige et typographie sans empattement. » Structure d'abord donne bien moins de retouches.

Soyez explicite sur ce que vous ne voulez pas

ChatGPT n'a pas de champ de prompt négatif. La restriction s'intègre dans la demande elle-même, et fonctionne mieux sous forme affirmative : « composition épurée, sans aucun texte à part le titre » rend mieux que « sans texte ».

Itérez plutôt que de tout réécrire

C'est le plus grand avantage de l'interface conversationnelle. Ne réécrivez pas le prompt de zéro quand quelque chose sort mal : demandez la correction. « Garde tout, mais change le fond en bleu marine » préserve ce qui était déjà bon. Réécrire tout le prompt génère une nouvelle image sans rapport avec la précédente.

💡 Astuce utile : demandez à ChatGPT lui-même d'améliorer votre prompt avant de générer. « Réécris cette demande comme un prompt d'image détaillé, sans encore rien générer » révèle souvent des détails auxquels vous n'aviez pas pensé.

Format et résolution : quoi demander

Le modèle accepte une large gamme de formats, de l'ultra-large à l'ultra-haut, et génère jusqu'à 2K. Définir le format avant de générer évite un recadrage ultérieur — et recadrer après coûte toujours de la composition.

DestinationComment demanderFormat
Fil Instagramformat carré1:1
Fil vertical / portraitformat portrait pour fil4:5
Stories et Reelsformat vertical de stories9:16
Miniature YouTubeformat horizontal widescreen16:9
Bannière de siteformat panoramique large3:1
Couverture d'ebookformat vertical de couverture de livre2:3
Fond d'écran de bureauformat horizontal widescreen16:9

Si vous avez besoin d'une résolution précise — 1920 par 1080, par exemple — générez dans le bon format et ajustez ensuite avec le redimensionneur d'image. Demander des dimensions exactes en pixels dans le prompt est rarement respecté à la lettre.

Éditer des images : les commandes qui fonctionnent

C'est là que ChatGPT se démarque des outils de génération pure. Pas besoin de masque, de calque ni de sélection — décrivez avec des mots.

Modifier un élément spécifique

« Garde la composition et change seulement la couleur du mur en vert sauge. » Plus vous êtes explicite sur ce qui doit rester identique, moins le modèle touche au reste. Le mot « garde » fait un travail étonnamment important ici.

Ajouter ou supprimer des objets

« Enlève la plante dans le coin droit et laisse le mur lisse. » Fonctionne bien avec des objets clairement délimités. Les suppressions dans des zones à fond très texturé laissent parfois des traces — dans ce cas, régénérer donne généralement un meilleur résultat que d'insister sur l'édition.

Changer le style en gardant la scène

« Même composition, mêmes éléments, mais en style aquarelle. » Utile pour tester différents langages visuels sans perdre le cadrage déjà approuvé.

Éditer à partir d'une de vos images

Vous pouvez envoyer une photo et demander des modifications : changer le fond, ajuster l'éclairage, transformer en illustration, créer des variantes. Notez que le résultat est une nouvelle image générée à partir de la vôtre, pas une édition pixel par pixel de l'original.

Étendre le cadrage

« Étends cette image au format horizontal, en continuant le décor naturellement sur les côtés. » C'est l'équivalent conversationnel de l'outpainting, et résout le cas classique d'une image verticale qui doit devenir une bannière.

Comment garder le même personnage sur plusieurs images

C'était le problème le plus difficile des IA d'image, et il est devenu bien plus gérable. Trois approches, de la plus simple à la plus fiable.

Continuer dans la même conversation. C'est la méthode la plus simple et la plus efficace au quotidien. Après avoir généré le personnage, demandez la scène suivante sans le redécrire : « montre maintenant le même personnage assis dans un café ». Le modèle porte le contexte de la conversation et garde les traits.

Décrire des traits fixes par écrit. Créez une description courte et immuable — cheveux, yeux, vêtement caractéristique, accessoire marquant — et répétez exactement les mêmes mots dans chaque demande. Les synonymes posent problème : « manteau beige » et « pardessus couleur sable » produisent des pièces différentes.

Demander d'abord une planche de référence. Générez une fiche de personnage avec le même visage sous plusieurs angles et expressions, et utilisez cette image comme référence dans les générations suivantes. C'est le chemin le plus laborieux et le plus cohérent, surtout pour les longues séries.

La même logique s'applique aux produits et à l'identité de marque : plus la description est fixe, plus le résultat est stable.

Gratuit ou payant : ce qui change vraiment

La génération d'images est disponible sur tous les plans, y compris le gratuit. Ce qui varie, c'est le volume, la vitesse et l'accès au mode avec raisonnement.

AspectPlan gratuitPlans payants
Génération d'imageDisponible, mode instantanéDisponible, instantané et raisonnement
VolumeLimité, quota non communiquéBien plus élevé
VitessePlus lente, sujette à file d'attentePriorité aux heures de pointe
Recherche web pendant la générationNonOui, en mode raisonnement
Mises en page complexes et infographiesRésultat irrégulierBien plus fiable
Ensembles d'images cohérentsLimitéOui

Pour un usage personnel occasionnel — un fond d'écran, une illustration pour un post, une image de support — le plan gratuit suffit. Pour un travail récurrent avec mise en page, texte et volume, la différence se voit vite. Si vous voulez comparer avec d'autres options avant de vous abonner, le guide des meilleures IA pour créer des images met les principaux noms côte à côte, et le guide de Gemini pour créer des images couvre la principale alternative.

Ce que ChatGPT ne fait pas encore bien

Connaître les limites fait gagner du temps. Aucune d'elles n'est un défaut de prompt : ce sont des limites de l'outil.

Sept erreurs les plus gênantes

  1. Écrire en format de tags. Une liste de mots séparés par des virgules est le langage d'autres outils. Ici, la prose rend mieux.
  2. Ne pas indiquer le format. Sans indication, le modèle choisit — et choisit presque toujours le mauvais format pour votre usage.
  3. Réécrire le prompt à chaque tentative. Vous perdez ce qui était déjà bon. Demandez des corrections ponctuelles.
  4. Laisser le texte flou dans la demande. Sans guillemets ni position, le modèle paraphrase ou le place où il veut.
  5. Enregistrer par capture d'écran. Perd en résolution et ajoute une recompression. Utilisez le téléchargement.
  6. Tout demander en une fois. Les prompts avec dix exigences simultanées échouent souvent sur deux ou trois. Générez la base et ajustez par étapes.
  7. Publier directement sans optimiser. Une image de 2K en PNG pèse plusieurs mégaoctets et ralentit le chargement de n'importe quelle page.

Que faire de l'image après la génération

Ce dernier point mérite qu'on s'y attarde, car c'est là que la plupart des gens se trompent. L'image qui sort de ChatGPT est prête à être vue, pas à être publiée.

Convertissez au bon format. Le PNG est excellent pour la transparence et mauvais pour une photo sur le web. Pour un site, le WebP réduit généralement le poids de moitié sans différence visible ; pour un envoi courant, le JPG fait l'affaire. Le convertisseur d'image fait le changement directement dans le navigateur, et le guide des formats d'image aide à choisir.

Réduisez le poids. Une image en 2K peut dépasser 5 Mo. Le compresseur d'image en réduit une bonne partie sans perte visible — et si le fichier est vraiment volumineux, le guide comment réduire une image de Mo à Ko couvre les détails.

Isolez l'objet si nécessaire. Pour les logos, produits et éléments destinés à un fond coloré, supprimer le fond et enregistrer en PNG transparent est l'étape qui manque.

Ajustez la résolution et le cadrage. Si l'image est ressortie plus petite que nécessaire, vous pouvez augmenter la résolution sans perdre en qualité. Si elle est au mauvais format, recadrer préserve plus qu'étirer.

Profitez de la palette. Pour garder une cohérence visuelle entre des images générées lors de sessions différentes, extrayez les couleurs de celle qui a le mieux fonctionné et citez ces tons dans les prompts suivants.

💡 Ordre qui fonctionne : téléchargez en pleine résolution → recadrez ou redimensionnez → convertissez le format → compressez en dernier. Compresser avant de redimensionner gaspille de la qualité.

Trois exemples de demandes complètes

Pour finir, trois demandes écrites de la façon dont ChatGPT en tire le meilleur parti — remarquez qu'elles indiquent toutes la finalité, le texte exact et le format.

Crée une affiche verticale promotionnelle pour un atelier photo. Le titre doit être « Lumière Naturelle » en grandes lettres en haut, et en dessous, plus petit, « samedi 12 juillet — 14h à 18h ». Fond dans un ton terreux avec une silhouette d'appareil photo en trait fin. Style minimaliste, typographie sans empattement, beaucoup d'espace vide. Format vertical pour stories.
Génère une infographie horizontale avec trois colonnes égales expliquant les étapes d'un processus. Chaque colonne a une icône simple en haut, un titre court et une phrase de soutien. Les titres sont « Collecter », « Analyser » et « Publier ». Palette en bleu marine, blanc et une touche d'orange en accent. Style éditorial épuré, sans ombres. Format widescreen.
Crée une photo de produit carrée d'un pot de crème blanche mate sur pierre claire, avec des feuilles vertes fraîches autour et un fond beige doux. Lumière naturelle diffuse venant de la gauche, gros plan frontal, esthétique clean de skincare. Sans aucun texte sur l'image.

Checklist avant de générer

Préparez vos images pour la publication

Les images générées en 2K dépassent facilement 5 Mo. Réduisez le poids sans perte de qualité visible, directement dans le navigateur.

Compresser l'image

Questions fréquentes

Peut-on créer des images avec ChatGPT gratuit ?
Oui. La génération d'images est disponible sur tous les plans, y compris le gratuit, en mode instantané. Ce qui change, c'est le volume autorisé, la vitesse aux heures de pointe et l'accès au mode avec raisonnement, réservé aux plans payants. OpenAI ne communique pas le nombre exact d'images du plan gratuit, et cette limite varie selon la demande sur la plateforme, donc tout chiffre précis que vous trouverez ailleurs doit être considéré comme une estimation.
ChatGPT utilise-t-il encore DALL·E ?
Non. Depuis avril 2026, la génération d'images fonctionne sur ChatGPT Images 2.0, un modèle natif intégré à ChatGPT lui-même. DALL·E 2 et DALL·E 3 ont été retirés en mai 2026. La différence pratique est importante : comme le modèle d'image partage le contexte avec le modèle de langage, il comprend la demande directement, sans l'étape intermédiaire de traduction qui existait avant et qui rendait le résultat irrégulier.
Pourquoi le texte de mon image est-il incorrect ?
Deux causes couvrent presque tous les cas. La première est de ne pas avoir mis le texte entre guillemets : sans cela, le modèle interprète le mot comme un thème et peut le paraphraser. La seconde est un excès de texte — les paragraphes longs et denses ont encore plus de risques d'erreur que les titres et phrases courtes. Si le texte est essentiel et continue de sortir incorrect, le moyen le plus fiable est de générer l'image sans texte et d'ajouter les mots ensuite dans un éditeur.
Quelle est la résolution maximale des images ?
Le modèle génère jusqu'à 2K, avec une large gamme de formats allant de l'ultra-large à l'ultra-haut. Cela convient bien à un usage numérique : réseaux sociaux, site web, présentation et miniature. Pour une impression grand format ou un fond d'écran de moniteur 4K, il faut agrandir l'image après la génération, ce qui fonctionne bien quand l'image est nette et peu détaillée.
Puis-je utiliser commercialement les images que je génère ?
Les conditions d'utilisation d'OpenAI permettent un usage commercial des images générées, mais les règles peuvent changer et varient selon le plan et le pays. De plus, un usage commercial n'équivaut pas à une protection légale : dans plusieurs juridictions, les œuvres créées entièrement par une machine font face à des restrictions d'enregistrement des droits d'auteur. Avant de les utiliser pour un client ou un produit à vendre, vérifiez les conditions en vigueur et évitez les demandes impliquant des marques déposées, des personnages sous licence ou des personnes réelles.
Comment faire pour que ChatGPT génère l'image avec un fond transparent ?
Même en le demandant explicitement, le résultat arrive généralement avec un fond uni plutôt qu'une vraie transparence. Le moyen le plus rapide est de demander un fond blanc uni, le plus facile à détourer, puis de créer la transparence ensuite en supprimant le fond et en enregistrant en PNG. Cette étape prend quelques secondes et donne un résultat plus propre que d'insister auprès du modèle, qui a tendance à renvoyer un fond en damier imitant la transparence.