Créer des images avec ChatGPT n'est plus une fonctionnalité secondaire : c'est devenu l'une des choses que l'outil fait le mieux. Depuis avril 2026, la génération d'images fonctionne sur ChatGPT Images 2.0, un modèle natif qui a définitivement remplacé DALL·E — retiré en mai de la même année — et qui a résolu le problème le plus persistant de toute IA d'image : écrire du texte à l'intérieur de l'image sans se tromper dans les lettres.
Cela change le type de choses qu'on peut faire. Une affiche avec un titre lisible, un infographique avec des chiffres corrects, une couverture avec le nom de la marque, une page de bande dessinée avec des dialogues, une maquette d'emballage avec une étiquette — tout cela sortait de travers auparavant et sort désormais propre dans la plupart des tentatives.
Ce guide couvre le parcours complet : comment générer la première image, comment écrire le prompt de la façon dont ChatGPT le comprend le mieux, comment éditer sans tout régénérer, comment garder le même personnage entre les images, ce qui change entre le plan gratuit et le plan payant, et ce que l'outil ne fait pas encore bien.
Ce qui a changé dans la génération d'images de ChatGPT
Jusqu'en 2025, ChatGPT générait des images en faisant appel à DALL·E comme système séparé : vous écriviez, il traduisait votre demande en un prompt interne et l'envoyait à un autre modèle. Le résultat était irrégulier, car il y avait une traduction intermédiaire que vous ne contrôliez pas.
Aujourd'hui, le modèle d'image est natif et partage le contexte avec le modèle de langage. En pratique, cela signifie qu'il comprend la demande de la même façon qu'il comprend une question textuelle : si vous dites « fais une affiche pour un café qui ouvre à 7h à Porto Alegre », il n'a pas besoin que vous décriviez chaque élément visuel — il déduit la mise en page, la hiérarchie et le contenu.
Trois conséquences pratiques comptent plus que les autres :
- Le texte dans l'image fonctionne. Titres, paragraphes, étiquettes, légendes et même texte en plusieurs langues ressortent lisibles. C'était le plus grand talon d'Achille des IA d'image.
- Une mise en page complexe est possible. Infographies, doubles pages de magazine, fiches de personnage et pages à panneaux multiples ne relèvent plus de la chance.
- La cohérence entre les images s'est améliorée. On peut générer un ensemble d'images en gardant le même personnage ou le même produit.
💡 À savoir : les limites de génération d'images du plan gratuit ne sont pas communiquées officiellement et évoluent selon la demande sur la plateforme. Considérez tout chiffre trouvé ailleurs comme une estimation, pas une règle fixe.
Comment générer votre première image, étape par étape
Le flux est aussi simple que possible — il n'existe ni panneau séparé ni configuration préalable obligatoire.
- Ouvrez une nouvelle conversation. Aucun mode spécial à sélectionner ; il suffit de demander.
- Décrivez l'image en langage naturel. Écrivez comme si vous expliquiez à un designer, en phrases complètes. N'utilisez pas de liste de mots séparés par des virgules : ce format vient d'autres outils et rend moins bien ici.
- Indiquez le format. « Format vertical pour stories », « carré pour Instagram », « horizontal 16:9 ». Si vous ne le dites pas, il choisit seul.
- Attendez la génération. Les images prennent plus de temps que les réponses textuelles, surtout celles à mise en page dense.
- Demandez des ajustements dans la même conversation. « Assombris le fond », « agrandis le titre », « change la couleur du manteau en rouge ». Il garde l'image et modifie seulement ce que vous avez demandé.
- Téléchargez en pleine résolution. Utilisez le bouton de téléchargement, pas une capture d'écran — la capture perd en qualité et arrive à la taille de votre fenêtre.
Ce dernier point est plus important qu'il n'y paraît. Beaucoup de gens enregistrent l'image en cliquant droit sur la miniature et se retrouvent avec un petit fichier recompressé.
Les deux modes : instantané et raisonnement
ChatGPT Images 2.0 fonctionne selon deux modes, et comprendre la différence évite bien des frustrations.
Le mode instantané génère directement à partir de votre demande. Il est rapide, disponible sur tous les plans y compris le gratuit, et couvre bien les images simples : une scène, un portrait, une illustration, un fond.
Le mode avec raisonnement — le « thinking » — fait planifier le modèle avant de dessiner : il vérifie le nombre d'objets, contrôle les contraintes demandées, organise la mise en page et, si nécessaire, effectue une recherche web pour intégrer une information actualisée dans l'image. C'est ce mode qui produit un infographique correct, une affiche avec des données réelles et une composition avec de nombreux éléments alignés. Il est réservé aux plans payants.
En pratique : si votre demande concerne une seule scène, le mode instantané suffit. S'il y a un comptage (« exactement cinq icônes »), une hiérarchie de texte ou des données qui doivent être exactes, le raisonnement fait une vraie différence.
Comment écrire des prompts que ChatGPT comprend le mieux
Voici la plus grande différence entre ChatGPT et des outils comme Midjourney : il préfère la prose à une liste de tags. Écrire « femme, 35 ans, blazer gris, bureau, 85mm, bokeh » fonctionne, mais rend moins bien que la même information en phrases.
Commencez par la fonction de l'image, pas la description
Dire à quoi elle sert change tout le résultat. « Une affiche promotionnelle pour l'atelier photo du 12 » produit quelque chose de bien plus utilisable que « une image avec un appareil photo et du texte ». Le modèle utilise la finalité pour décider de la hiérarchie, de l'espace et du style.
Écrivez le texte exact entre guillemets
Quand l'image doit contenir des mots, écrivez-les littéralement et entre guillemets : le titre « Petit-déjeuner », le sous-titre « tous les samedis, de 8h à 11h ». Sans guillemets, le modèle peut paraphraser ou inventer. Et indiquez où se trouve chaque texte : en haut, en bas, dans le coin inférieur droit.
Décrivez la structure avant le style
L'ordre qui fonctionne est : ce qui apparaît et où → puis à quoi ça ressemble. « Trois colonnes égales, icône en haut de chacune, titre en dessous et un court paragraphe en bas ; style minimaliste avec fond beige et typographie sans empattement. » Structure d'abord donne bien moins de retouches.
Soyez explicite sur ce que vous ne voulez pas
ChatGPT n'a pas de champ de prompt négatif. La restriction s'intègre dans la demande elle-même, et fonctionne mieux sous forme affirmative : « composition épurée, sans aucun texte à part le titre » rend mieux que « sans texte ».
Itérez plutôt que de tout réécrire
C'est le plus grand avantage de l'interface conversationnelle. Ne réécrivez pas le prompt de zéro quand quelque chose sort mal : demandez la correction. « Garde tout, mais change le fond en bleu marine » préserve ce qui était déjà bon. Réécrire tout le prompt génère une nouvelle image sans rapport avec la précédente.
💡 Astuce utile : demandez à ChatGPT lui-même d'améliorer votre prompt avant de générer. « Réécris cette demande comme un prompt d'image détaillé, sans encore rien générer » révèle souvent des détails auxquels vous n'aviez pas pensé.
Format et résolution : quoi demander
Le modèle accepte une large gamme de formats, de l'ultra-large à l'ultra-haut, et génère jusqu'à 2K. Définir le format avant de générer évite un recadrage ultérieur — et recadrer après coûte toujours de la composition.
| Destination | Comment demander | Format |
|---|---|---|
| Fil Instagram | format carré | 1:1 |
| Fil vertical / portrait | format portrait pour fil | 4:5 |
| Stories et Reels | format vertical de stories | 9:16 |
| Miniature YouTube | format horizontal widescreen | 16:9 |
| Bannière de site | format panoramique large | 3:1 |
| Couverture d'ebook | format vertical de couverture de livre | 2:3 |
| Fond d'écran de bureau | format horizontal widescreen | 16:9 |
Si vous avez besoin d'une résolution précise — 1920 par 1080, par exemple — générez dans le bon format et ajustez ensuite avec le redimensionneur d'image. Demander des dimensions exactes en pixels dans le prompt est rarement respecté à la lettre.
Éditer des images : les commandes qui fonctionnent
C'est là que ChatGPT se démarque des outils de génération pure. Pas besoin de masque, de calque ni de sélection — décrivez avec des mots.
Modifier un élément spécifique
« Garde la composition et change seulement la couleur du mur en vert sauge. » Plus vous êtes explicite sur ce qui doit rester identique, moins le modèle touche au reste. Le mot « garde » fait un travail étonnamment important ici.
Ajouter ou supprimer des objets
« Enlève la plante dans le coin droit et laisse le mur lisse. » Fonctionne bien avec des objets clairement délimités. Les suppressions dans des zones à fond très texturé laissent parfois des traces — dans ce cas, régénérer donne généralement un meilleur résultat que d'insister sur l'édition.
Changer le style en gardant la scène
« Même composition, mêmes éléments, mais en style aquarelle. » Utile pour tester différents langages visuels sans perdre le cadrage déjà approuvé.
Éditer à partir d'une de vos images
Vous pouvez envoyer une photo et demander des modifications : changer le fond, ajuster l'éclairage, transformer en illustration, créer des variantes. Notez que le résultat est une nouvelle image générée à partir de la vôtre, pas une édition pixel par pixel de l'original.
Étendre le cadrage
« Étends cette image au format horizontal, en continuant le décor naturellement sur les côtés. » C'est l'équivalent conversationnel de l'outpainting, et résout le cas classique d'une image verticale qui doit devenir une bannière.
Comment garder le même personnage sur plusieurs images
C'était le problème le plus difficile des IA d'image, et il est devenu bien plus gérable. Trois approches, de la plus simple à la plus fiable.
Continuer dans la même conversation. C'est la méthode la plus simple et la plus efficace au quotidien. Après avoir généré le personnage, demandez la scène suivante sans le redécrire : « montre maintenant le même personnage assis dans un café ». Le modèle porte le contexte de la conversation et garde les traits.
Décrire des traits fixes par écrit. Créez une description courte et immuable — cheveux, yeux, vêtement caractéristique, accessoire marquant — et répétez exactement les mêmes mots dans chaque demande. Les synonymes posent problème : « manteau beige » et « pardessus couleur sable » produisent des pièces différentes.
Demander d'abord une planche de référence. Générez une fiche de personnage avec le même visage sous plusieurs angles et expressions, et utilisez cette image comme référence dans les générations suivantes. C'est le chemin le plus laborieux et le plus cohérent, surtout pour les longues séries.
La même logique s'applique aux produits et à l'identité de marque : plus la description est fixe, plus le résultat est stable.
Gratuit ou payant : ce qui change vraiment
La génération d'images est disponible sur tous les plans, y compris le gratuit. Ce qui varie, c'est le volume, la vitesse et l'accès au mode avec raisonnement.
| Aspect | Plan gratuit | Plans payants |
|---|---|---|
| Génération d'image | Disponible, mode instantané | Disponible, instantané et raisonnement |
| Volume | Limité, quota non communiqué | Bien plus élevé |
| Vitesse | Plus lente, sujette à file d'attente | Priorité aux heures de pointe |
| Recherche web pendant la génération | Non | Oui, en mode raisonnement |
| Mises en page complexes et infographies | Résultat irrégulier | Bien plus fiable |
| Ensembles d'images cohérents | Limité | Oui |
Pour un usage personnel occasionnel — un fond d'écran, une illustration pour un post, une image de support — le plan gratuit suffit. Pour un travail récurrent avec mise en page, texte et volume, la différence se voit vite. Si vous voulez comparer avec d'autres options avant de vous abonner, le guide des meilleures IA pour créer des images met les principaux noms côte à côte, et le guide de Gemini pour créer des images couvre la principale alternative.
Ce que ChatGPT ne fait pas encore bien
Connaître les limites fait gagner du temps. Aucune d'elles n'est un défaut de prompt : ce sont des limites de l'outil.
- Personnes réelles. Générer des images de personnes identifiables, en particulier des figures publiques, est bloqué. Reformuler la demande ne sert à rien.
- Marques et personnages sous licence. Les logos d'entreprises existantes et les personnages protégés par le droit d'auteur sont également refusés.
- Vecteur véritable. La sortie est toujours rastérisée, en pixels. Si vous avez besoin d'un fichier éditable en courbes, le résultat sert de référence pour redessiner, pas de fichier final.
- Fond transparent fiable. Même en le demandant, l'image arrive généralement avec un fond uni. La transparence se règle plus vite après coup, en supprimant le fond.
- Résolution au-delà de 2K. Pour une grande impression ou un moniteur 4K, il faut agrandir après coup.
- Reproduction exacte d'une de vos photos. En éditant une image envoyée, le modèle régénère la scène. Les détails fins de l'original changent.
Sept erreurs les plus gênantes
- Écrire en format de tags. Une liste de mots séparés par des virgules est le langage d'autres outils. Ici, la prose rend mieux.
- Ne pas indiquer le format. Sans indication, le modèle choisit — et choisit presque toujours le mauvais format pour votre usage.
- Réécrire le prompt à chaque tentative. Vous perdez ce qui était déjà bon. Demandez des corrections ponctuelles.
- Laisser le texte flou dans la demande. Sans guillemets ni position, le modèle paraphrase ou le place où il veut.
- Enregistrer par capture d'écran. Perd en résolution et ajoute une recompression. Utilisez le téléchargement.
- Tout demander en une fois. Les prompts avec dix exigences simultanées échouent souvent sur deux ou trois. Générez la base et ajustez par étapes.
- Publier directement sans optimiser. Une image de 2K en PNG pèse plusieurs mégaoctets et ralentit le chargement de n'importe quelle page.
Que faire de l'image après la génération
Ce dernier point mérite qu'on s'y attarde, car c'est là que la plupart des gens se trompent. L'image qui sort de ChatGPT est prête à être vue, pas à être publiée.
Convertissez au bon format. Le PNG est excellent pour la transparence et mauvais pour une photo sur le web. Pour un site, le WebP réduit généralement le poids de moitié sans différence visible ; pour un envoi courant, le JPG fait l'affaire. Le convertisseur d'image fait le changement directement dans le navigateur, et le guide des formats d'image aide à choisir.
Réduisez le poids. Une image en 2K peut dépasser 5 Mo. Le compresseur d'image en réduit une bonne partie sans perte visible — et si le fichier est vraiment volumineux, le guide comment réduire une image de Mo à Ko couvre les détails.
Isolez l'objet si nécessaire. Pour les logos, produits et éléments destinés à un fond coloré, supprimer le fond et enregistrer en PNG transparent est l'étape qui manque.
Ajustez la résolution et le cadrage. Si l'image est ressortie plus petite que nécessaire, vous pouvez augmenter la résolution sans perdre en qualité. Si elle est au mauvais format, recadrer préserve plus qu'étirer.
Profitez de la palette. Pour garder une cohérence visuelle entre des images générées lors de sessions différentes, extrayez les couleurs de celle qui a le mieux fonctionné et citez ces tons dans les prompts suivants.
💡 Ordre qui fonctionne : téléchargez en pleine résolution → recadrez ou redimensionnez → convertissez le format → compressez en dernier. Compresser avant de redimensionner gaspille de la qualité.
Trois exemples de demandes complètes
Pour finir, trois demandes écrites de la façon dont ChatGPT en tire le meilleur parti — remarquez qu'elles indiquent toutes la finalité, le texte exact et le format.
Checklist avant de générer
- Avez-vous dit à quoi sert l'image, pas seulement ce qu'elle montre ?
- Le format est-il déclaré ?
- Le texte qui doit apparaître est-il entre guillemets, avec une position définie ?
- La structure a-t-elle été décrite avant le style ?
- Les contraintes sont-elles écrites sous forme affirmative ?
- Demandez-vous une correction plutôt que de tout réécrire ?
- Allez-vous télécharger en pleine résolution, et non par capture d'écran ?
Préparez vos images pour la publication
Les images générées en 2K dépassent facilement 5 Mo. Réduisez le poids sans perte de qualité visible, directement dans le navigateur.
Compresser l'image