Si vous avez déjà cherché comment générer des images avec Gemini, vous êtes probablement tombé sur une confusion de noms : Nano Banana, Nano Banana 2, Nano Banana Pro, Gemini 3.1 Flash Image. On dirait des produits différents, mais ce n'est pas le cas — Nano Banana est simplement le nom de la génération d'images native de Gemini, et les autres en sont des versions.

Cette clarification compte, car le choix du modèle est la décision qui affecte le plus le résultat. Une infographie avec du texte dense faite avec le modèle rapide ressort avec des lettres tordues ; la même demande avec le modèle Pro ressort lisible. Savoir lequel utiliser dans chaque cas fait gagner des tentatives et du quota quotidien.

Ce guide couvre les trois modèles et quand utiliser chacun, les étapes de génération, comment écrire des prompts de la façon dont Gemini en tire le meilleur parti, l'édition conversationnelle qui est le principal atout de l'outil, et ses limites réelles.

Qu'est-ce que Nano Banana

Nano Banana est le nom de la capacité native de génération et d'édition d'images de Gemini. Native signifie que le modèle d'image est intégré à Gemini lui-même, et non déclenché comme un système séparé — il comprend la demande dans le même contexte que la conversation, y compris les images que vous avez envoyées et ce qui a déjà été dit.

En février 2026, Nano Banana 2 est devenu le chemin standard de génération d'images sur les principales surfaces de Google, y compris l'application Gemini. Nano Banana Pro continue d'exister comme option haute fidélité, principalement pour les personnes avec un plan payant.

Les trois modèles et quand utiliser chacun

Dans Gemini, le menu des modèles apparaît avec des noms de comportement — Rapide, Raisonnement et Pro. En arrière-plan, ils correspondent à trois modèles distincts.

ModèleProfilÀ utiliser quand
Nano Banana 2 Lite (Rapide)Le plus rapide et économiqueTests, variantes rapides, images simples d'une seule scène
Nano Banana 2 (Raisonnement)Le généraliste, standard pour presque toutLa plupart des cas : scènes, portraits, produits, illustrations
Nano Banana ProHaute fidélité, texte et mise en page complexesInfographies, affiches avec texte dense, pièces de production

Une caractéristique utile du flux : vous pouvez d'abord générer avec le modèle standard et, si le résultat demande plus de détail, refaire la même image avec le Pro. Sur les plans payants, l'option apparaît dans le menu à trois points de l'image générée, sous « Refaire avec le Pro ». La limite est qu'une fois le quota quotidien du modèle standard épuisé, le retraitement en Pro cesse aussi d'être disponible.

💡 Stratégie de quota : utilisez le modèle rapide pour trouver la composition qui fonctionne, puis refaites seulement celle-ci avec le Pro. Dépenser les générations du modèle le plus coûteux en tests est l'erreur qui gaspille le plus de quota quotidien.

Comment générer votre première image

  1. Ouvrez Gemini. Sur ordinateur, accédez-y via le navigateur ; sur mobile, via l'application.
  2. Accédez à la section images. Dans la barre latérale se trouve une section Images ; sinon, le menu d'outils propose l'option de créer des images.
  3. Choisissez le modèle. Rapide, Raisonnement ou Pro, selon le tableau ci-dessus. En cas de doute, commencez par le standard.
  4. Écrivez la demande en langage naturel. Des phrases complètes fonctionnent mieux que des listes de mots séparés par des virgules.
  5. Demandez des ajustements dans la même conversation. « Assombris le fond », « change pour la fin d'après-midi », « enlève la plante dans le coin ». Il garde l'image et modifie seulement ce qui a été demandé.
  6. Téléchargez en pleine résolution. Utilisez le bouton de téléchargement, jamais une capture d'écran.

Résolution : ce que vous pouvez télécharger

La résolution de téléchargement dépend du plan. Sans plan payant Google IA, le téléchargement se fait en 1K. Avec un plan, il est possible de télécharger en 2K. Nano Banana Pro est la voie vers des sorties de plus haute fidélité, y compris pour du matériel avec texte et mise en page qui doit supporter l'agrandissement.

En pratique, cela signifie que pour un usage numérique courant — post, miniature, image de blog, présentation — ce que Gemini fournit suffit déjà. Pour une impression grand format ou un moniteur haute résolution, il faudra agrandir après la génération. Il est possible d'augmenter la résolution de l'image sans perdre en qualité, et le résultat est généralement bon quand l'image est nette et peu détaillée.

Comment écrire des prompts pour Gemini

Google lui-même suggère une formule de départ simple : demandez la création d'une image en indiquant le sujet, l'action et la scène. C'est un bon point de départ — et l'étape suivante consiste justement à l'étoffer.

Commencez par la formule, puis détaillez

Une demande minimale ressemblerait à ceci :

Crée l'image d'un chat faisant la sieste dans un rayon de soleil sur le rebord d'une fenêtre.

Cela donne déjà un résultat. Mais chaque couche supplémentaire rapproche le résultat de ce que vous aviez imaginé :

Crée l'image d'un chat noir faisant la sieste, roulé en boule dans un rayon de soleil sur le rebord d'une fenêtre en bois, rideau en lin à côté ondulant légèrement, poussière en suspension visible dans la lumière, plan moyen latéral, lumière chaude de fin d'après-midi, tons beige et ambre, photographie domestique contemplative.

Écrivez en prose, pas en tags

C'est la différence la plus importante par rapport à des outils comme Midjourney. Gemini est conversationnel et tire mieux parti de phrases complètes que de listes de termes séparés par des virgules. Écrivez comme si vous décriviez la scène à quelqu'un.

Indiquez le format

Si vous ne l'indiquez pas, le modèle choisit. Dites « format vertical pour stories », « carré pour Instagram », « horizontal widescreen » ou le format directement.

Mettez le texte entre guillemets

Quand l'image doit contenir des mots, écrivez-les littéralement entre guillemets et indiquez leur position. Sans cela, le modèle peut paraphraser ou les placer où il le juge bon.

Itérez plutôt que de tout réécrire

Si quelque chose sort mal, demandez la correction spécifique plutôt que de tout réécrire. « Garde la composition et change seulement la couleur du manteau en vert » préserve ce qui était déjà bon. Réécrire tout le prompt génère une nouvelle image sans rapport avec la précédente.

Édition conversationnelle : le principal atout

C'est là que Gemini se démarque. Vous envoyez une image — générée par lui ou la vôtre — et décrivez la modification avec des mots, sans masque, calque ni sélection.

Changer le fond

Garder le sujet et remplacer l'environnement derrière lui. Utile pour les portraits, produits et supports marketing.

Garde la personne exactement telle qu'elle est et remplace le fond par un mur en béton brut clair, avec une lumière naturelle diffuse venant de la gauche. Préserve l'éclairage sur le visage.

Changer la météo et l'heure

Transformer un jour ensoleillé en nuit, ajouter de la pluie, remplacer l'automne par l'hiver. La même scène avec une autre atmosphère.

Garde la composition et tous les éléments. Passe d'un jour ensoleillé à une nuit pluvieuse, avec la rue mouillée reflétant les lumières et une brume basse.

Changer l'angle de caméra

Demander la même scène vue d'un autre point. Ce n'est pas parfait, car le modèle doit inventer ce qui n'était pas visible, mais cela fonctionne bien avec des scènes qui ont de l'espace.

Montre la même scène vue d'un angle plus bas, proche du sol, en gardant les mêmes objets, le même éclairage et le même style.

Transférer le style d'une référence

L'une des fonctionnalités les plus utiles et les moins connues : envoyer deux images et demander que la texture, la couleur ou le style de l'une soit appliqué à l'autre. C'est le moyen le plus rapide de tester des esthétiques sans repartir de zéro.

Applique la palette de couleurs et la texture de la deuxième image à la première, en gardant la composition, les objets et le cadrage de la première exactement identiques.

Ajouter ou supprimer des éléments

Enlever un objet indésirable, ajouter une plante, inclure une personne en arrière-plan. Fonctionne bien avec des éléments clairement délimités ; les suppressions dans des zones de texture complexe laissent parfois des traces.

Supprime la voiture garée à droite et complète la rue naturellement, en gardant le reste de l'image sans changement.

Travailler avec des images de référence

Envoyer des images avec la demande est là où Gemini montre le plus de force, et il vaut la peine de comprendre les trois façons de l'utiliser.

Référence de sujet. Vous envoyez la photo d'une personne, d'un produit ou d'un personnage et demandez qu'il apparaisse dans une nouvelle scène. Le modèle essaie de préserver l'identité du sujet et de changer tout le reste.

Référence de style. Vous envoyez une image dont vous voulez reproduire l'esthétique et demandez que la palette, la texture ou le langage visuel soit appliqué à une autre image ou à une scène décrite en texte.

Référence de composition. Vous envoyez une esquisse, une photo mal prise ou un brouillon et demandez qu'il soit transformé en image finalisée en gardant l'arrangement des éléments.

Un conseil pratique : plus la référence est nette, meilleur est le résultat. Les images avec un fond encombré font que le modèle intègre des éléments du décor sans que vous l'ayez demandé. Si votre référence a ce problème, supprimer le fond avant de l'envoyer améliore beaucoup le résultat.

Texte et infographies

Le rendu de texte lisible est l'une des avancées les plus visibles de cette génération de modèles, et c'est justement là que Nano Banana Pro se justifie. Affiche avec titre et sous-titre, infographie avec étiquettes, diagramme à partir de notes, couverture avec nom de marque — tout cela sortait de travers il y a peu et sort désormais propre dans la plupart des tentatives.

Trois choses améliorent beaucoup le résultat avec du texte :

Malgré tout, pour des pièces où la typographie doit être celle de la marque, le moyen le plus fiable reste de générer l'image sans texte et d'ajouter le texte ensuite, avec la bonne police.

Huit demandes prêtes à l'emploi

Des modèles qui couvrent les besoins les plus courants. Remplacez ce qui est entre crochets et gardez le reste.

Image d'en-tête pour article

Crée une image horizontale widescreen sur [thème], avec une composition épurée, un élément central en focus et le côté gauche plus vide pour recevoir du texte. Éclairage naturel doux, palette en tons de [couleur] et neutres, sans aucun texte sur l'image.

Post carré pour réseau social

Crée une image carrée de [sujet] avec une esthétique minimaliste, fond uni en [couleur], ombre douce et beaucoup d'espace négatif autour de l'objet. Lumière diffuse uniforme, fort contraste entre l'objet et le fond, sans texte.

Affiche avec titre

Crée une affiche verticale promotionnelle pour [événement]. Titre « [texte exact] » en grandes lettres en haut et, plus petit, en dessous : « [texte exact] ». Fond en [couleur] avec un élément graphique simple. Style éditorial, typographie sans empattement, beaucoup d'espace vide.

Changer le fond d'une photo

Garde la personne exactement telle qu'elle est, sans changer le visage, les cheveux ni les vêtements. Remplace seulement le fond par [description du décor], en préservant la même direction de lumière qui l'éclaire.

Variante de style

Garde la même composition, les mêmes éléments et le même cadrage, mais refais l'image en style [aquarelle / illustration vectorielle / photographie réaliste], avec une palette [description].

Maquette de produit

Crée une photo de produit de [produit] sur [surface], fond [couleur] en dégradé doux, éclairage de studio avec softbox latéral, angle frontal légèrement surélevé, reflet contrôlé, netteté élevée, sans texte ni étiquette.

Infographie simple

Crée une infographie horizontale avec trois colonnes égales expliquant [thème]. Chaque colonne a une icône simple en haut, un titre court et une phrase de soutien. Les titres sont « [texte] », « [texte] » et « [texte] ». Palette en [deux couleurs], style éditorial épuré, sans ombres.

Nettoyer une photo

Supprime [élément indésirable] de l'image et complète la zone naturellement, en gardant tout le reste sans changement, avec le même éclairage et le même niveau de détail.

Cohérence de personnage sur Gemini

Comme l'édition est conversationnelle, la méthode la plus efficace est aussi la plus simple : rester dans le même fil de conversation. Après avoir généré le personnage, demandez les scènes suivantes sans le redécrire — « montre maintenant le même personnage assis dans un café » — et le contexte accumulé fait le travail.

Quand la série est longue ou que vous devez reprendre un autre jour, utilisez l'image comme référence de sujet et gardez une description fixe des traits permanents, répétée mot pour mot. Le guide sur la cohérence de personnage avec l'IA détaille les quatre méthodes et quand chacune se justifie.

Gemini ou ChatGPT : ce qui change en pratique

AspectGeminiChatGPT
Style de promptProse conversationnelleProse conversationnelle
Édition par conversationForte, avec bonne préservation de l'originalForte, avec bonne préservation de l'original
Images d'entrée multiplesPoint fort, y compris le transfert de stylePris en charge
Texte dans l'imageTrès bon, encore meilleur avec le modèle ProTrès bon
Choix du modèleExplicite : Rapide, Raisonnement ou ProInstantané ou raisonnement, selon le plan
Résolution de téléchargement1K en gratuit, 2K avec un planJusqu'à 2K

Les deux outils ont beaucoup convergé. Le critère pratique est de tester la même demande sur les deux et de comparer — puis d'utiliser celui qui donne le meilleur résultat pour votre type d'image. Le guide de ChatGPT pour créer des images couvre l'autre côté en détail, et le comparatif des meilleures IA pour créer des images met les principales options côte à côte.

Ce que Gemini ne fait pas bien

Sept erreurs les plus gênantes

  1. Utiliser le modèle Pro pour tester. Consomme un quota qui manquerait pour la version finale.
  2. Écrire en format de tags. Une liste de mots est le langage d'autres outils ; ici, la prose rend mieux.
  3. Ne pas indiquer le format. Sans indication, le format n'est presque jamais celui dont vous avez besoin.
  4. Réécrire le prompt à chaque tentative. Vous perdez ce qui était déjà bon. Demandez des corrections ponctuelles.
  5. Envoyer une référence au fond encombré. Le modèle intègre des éléments du décor sans que vous l'ayez demandé.
  6. Enregistrer par capture d'écran. Perd en résolution et ajoute une recompression.
  7. Publier sans optimiser. Les images en 2K pèsent lourd et ralentissent le chargement de n'importe quelle page.

Après la génération : préparer l'image

L'image qui sort de Gemini est prête à être vue, pas à être publiée. Quatre étapes suffisent.

Convertir le format. Le PNG est excellent pour la transparence et mauvais pour une photo sur le web. Pour un site, le WebP réduit généralement le poids de moitié sans différence visible ; pour un envoi courant, le JPG fait l'affaire. Le convertisseur d'image fait le changement dans le navigateur, et le guide des formats d'image aide à choisir.

Réduire le poids. Une image en 2K dépasse facilement plusieurs mégaoctets. Le compresseur d'image en réduit une bonne partie sans perte visible.

Ajuster la taille et le cadrage. Pour une dimension précise, utilisez le redimensionneur ; si le format est différent de ce qu'il fallait, recadrer préserve plus de qualité qu'étirer.

Isoler le sujet si nécessaire. Pour les produits, logos et éléments destinés à un fond coloré, supprimer le fond fournit le PNG transparent que la génération ne produit pas.

💡 Ordre qui fonctionne : télécharger en pleine résolution → recadrer ou redimensionner → convertir le format → compresser en dernier. Compresser avant de redimensionner gaspille de la qualité.

Checklist avant de générer

Convertissez vos images au bon format

Transformez le PNG lourd de Gemini en WebP ou JPG et préparez l'image pour la publication, directement dans le navigateur.

Convertir l'image

Questions fréquentes

Qu'est-ce que Nano Banana et quel est son lien avec Gemini ?
Nano Banana est le nom de la génération d'images native de Gemini — ce n'est ni un produit séparé ni une application à part. Il existe aujourd'hui trois modèles dans la famille : le Lite, axé sur la vitesse et le coût, le Nano Banana 2, généraliste standard depuis février 2026, et le Nano Banana Pro, haute fidélité, indiqué pour le texte dense et les mises en page complexes. Dans l'application, ils apparaissent dans le menu sous les noms Rapide, Raisonnement et Pro.
Peut-on créer des images gratuitement sur Gemini ?
Oui, avec des limitations. L'usage gratuit a un quota de génération quotidien et le téléchargement se fait en résolution 1K. Avec un plan payant Google IA, le téléchargement passe à 2K et l'option de refaire l'image avec Nano Banana Pro devient disponible. Un détail pratique qui piège beaucoup de monde : quand le quota quotidien du modèle standard est épuisé, le retraitement en Pro cesse aussi de fonctionner, même avec un abonnement.
Quel modèle choisir pour chaque type d'image ?
Pour la plupart des cas — scènes, portraits, produits, illustrations — le modèle standard suffit largement. Le modèle rapide sert à explorer des compositions et générer des variantes sans consommer le quota du plus coûteux. Le Pro se justifie quand la demande implique du texte dense, une infographie, un diagramme, une affiche avec hiérarchie typographique ou une pièce destinée à la production. La stratégie la plus économique est de tester en rapide et de ne refaire en Pro que la version choisie.
Comment éditer une de mes photos sur Gemini ?
Envoyez l'image dans la conversation et décrivez la modification en langage naturel — changer le fond, modifier l'éclairage, supprimer un objet, appliquer un autre style. Pas besoin de masque ni de sélection. Sachez que le résultat est une nouvelle image générée à partir de la vôtre, pas une édition pixel par pixel : la composition est préservée, mais les détails fins de l'original changent. Pour des modifications exigeant une fidélité absolue, un éditeur traditionnel reste plus adapté.
Comment obtenir un fond transparent ?
Même en le demandant explicitement, l'image arrive généralement avec un fond uni plutôt qu'une vraie transparence. Le moyen le plus rapide est de demander un fond blanc uni, le plus facile à détourer, puis de créer la transparence ensuite en supprimant le fond et en enregistrant en PNG. Insister auprès du modèle donne généralement un fond en damier imitant la transparence, qui ne sert à rien.
Puis-je utiliser commercialement les images générées ?
Les règles dépendent du plan, du pays et des conditions en vigueur de Google, et peuvent changer. De plus, l'autorisation d'usage commercial n'équivaut pas à une protection légale : dans plusieurs juridictions, les œuvres créées entièrement par une machine font face à des restrictions d'enregistrement des droits d'auteur. Avant de les utiliser pour un client ou un produit à vendre, vérifiez les conditions actuelles et évitez les demandes impliquant des marques déposées, des personnages sous licence ou des personnes réelles.